AI modellərinin diqqət zəifliyi: Uzun siyahılarda performans niyə kəskin düşür?
...
Süni intellekt
Oxumaq vaxt alır?
Məqalələri dinləyə bilərsizAI modellərinin diqqət sınağı
Tədqiqatçılar süni intellekt modellərinə məşhur Stroop testini tətbiq edərək onların diqqət qabiliyyətini ölçdülər. Qısa siyahılarda, məsələn, beş sözlü siyahıda GPT-4o 91% düzgünlük göstərdi. Lakin siyahı uzandıqca AI-nin performansı kəskin şəkildə azalmağa başladı.
Uzun siyahılar AI üçün çətinlik yaradır
On sözlü siyahıda GPT-4o-nun düzgünlüyü 57%-ə düşdü, qırx sözlü siyahıda isə cəmi 15% səviyyəsində qaldı. Claude 3.5 Sonnet modeli iyirmi sözə qədər sabit performans nümayiş etdirdi, lakin qırx sözlü siyahıda onun düzgünlüyü 24%-ə endi. GPT-5, Claude Opus 4.1 və Gemini 2.5 modelləri də oxşar nəticələr göstərdi.
AI diqqətinin əsas məhdudiyyətləri
Tədqiqatın nəticələri göstərir ki, AI modelləri uzun müddət diqqəti saxlamaqda çətinlik çəkir. Onlar rəngləri adlandırmaq əvəzinə sözləri oxumağa üstünlük verirlər ki, bu da uyğunsuz rəng və sözlərin qarışdığı siyahılarda düzgünlüyün demək olar sıfıra enməsinə səbəb olur.
İnsan və AI diqqət mexanizmləri arasındakı fərq
İnsanlar uzun siyahılarda diqqəti daha yaxşı qoruyur, çünki onların diqqət mexanizmləri AI-dan fərqlidir. AI sistemlərinin diqqəti saxlamaq üçün insanlarda olduğu kimi icra nəzarəti yoxdur. Bu, süni intellektin əsas məhdudiyyətlərindən biridir və gələcək inkişaflar üçün vacib istiqamət kimi qalır.
Nəticə
Bu tədqiqat süni intellektin diqqət zəifliyini və onun uzun və mürəkkəb tapşırıqlarda performansının necə zəiflədiyini ortaya qoyur. İnsanların diqqət qabiliyyəti ilə müqayisədə AI-nin bu sahədə hələ də ciddi çatışmazlıqları var. Bu, AI-nin gələcəkdə daha effektiv və insan kimi diqqət saxlaya bilən sistemlərə çevrilməsi üçün araşdırmaların davam etdirilməsinin vacibliyini göstərir.