AI modellərinin diqqət zəifliyi: Uzun siyahılarda performans niyə kəskin düşür?

Link kopyalandı

...

Bu gün, 04:30

Süni intellekt

Oxumaq vaxt alır?

Məqalələri dinləyə bilərsiz

AI modellərinin diqqət sınağı

Tədqiqatçılar süni intellekt modellərinə məşhur Stroop testini tətbiq edərək onların diqqət qabiliyyətini ölçdülər. Qısa siyahılarda, məsələn, beş sözlü siyahıda GPT-4o 91% düzgünlük göstərdi. Lakin siyahı uzandıqca AI-nin performansı kəskin şəkildə azalmağa başladı.

Uzun siyahılar AI üçün çətinlik yaradır

On sözlü siyahıda GPT-4o-nun düzgünlüyü 57%-ə düşdü, qırx sözlü siyahıda isə cəmi 15% səviyyəsində qaldı. Claude 3.5 Sonnet modeli iyirmi sözə qədər sabit performans nümayiş etdirdi, lakin qırx sözlü siyahıda onun düzgünlüyü 24%-ə endi. GPT-5, Claude Opus 4.1 və Gemini 2.5 modelləri də oxşar nəticələr göstərdi.

AI diqqətinin əsas məhdudiyyətləri

Tədqiqatın nəticələri göstərir ki, AI modelləri uzun müddət diqqəti saxlamaqda çətinlik çəkir. Onlar rəngləri adlandırmaq əvəzinə sözləri oxumağa üstünlük verirlər ki, bu da uyğunsuz rəng və sözlərin qarışdığı siyahılarda düzgünlüyün demək olar sıfıra enməsinə səbəb olur.

İnsan və AI diqqət mexanizmləri arasındakı fərq

İnsanlar uzun siyahılarda diqqəti daha yaxşı qoruyur, çünki onların diqqət mexanizmləri AI-dan fərqlidir. AI sistemlərinin diqqəti saxlamaq üçün insanlarda olduğu kimi icra nəzarəti yoxdur. Bu, süni intellektin əsas məhdudiyyətlərindən biridir və gələcək inkişaflar üçün vacib istiqamət kimi qalır.

Nəticə

Bu tədqiqat süni intellektin diqqət zəifliyini və onun uzun və mürəkkəb tapşırıqlarda performansının necə zəiflədiyini ortaya qoyur. İnsanların diqqət qabiliyyəti ilə müqayisədə AI-nin bu sahədə hələ də ciddi çatışmazlıqları var. Bu, AI-nin gələcəkdə daha effektiv və insan kimi diqqət saxlaya bilən sistemlərə çevrilməsi üçün araşdırmaların davam etdirilməsinin vacibliyini göstərir.

Link kopyalandı