DiffusionGemma: Mətn Generasiyasında Sürət və Paralellik İnqilabı Nə vəd edir?

Link kopyalandı

...

Bu gün, 18:00

Süni intellekt

Oxumaq vaxt alır?

Məqalələri dinləyə bilərsiz

DiffusionGemma modeli süni intellektdə yeni dövr açır

Süni intellekt sahəsində mətn generasiyasının sürəti və keyfiyyəti arasında tarazlıq tapmaq həmişə çətin olub. İndi isə DiffusionGemma adlı yeni açıq eksperimental model bu sahədə sürət baxımından böyük irəliləyiş təqdim edir. 26 milyard parametrlik Mixture of Experts (MoE) arxitekturasına əsaslanan bu model, ənənəvi ardıcıl token yaradılmasından fərqli olaraq, mətn blokları şəklində eyni anda generasiya edir və GPU-larda 4 dəfə daha sürətli nəticə verir.

GPU-larda rekord sürət və effektivlik

DiffusionGemma NVIDIA ilə əməkdaşlıq çərçivəsində müxtəlif GPU-larda optimallaşdırılıb. Məsələn, NVIDIA H100 GPU-da saniyədə 1000-dən çox token, NVIDIA GeForce RTX 5090-da isə 700-dən çox token generasiya edə bilir. Model yalnız 3.8 milyard parametri aktivləşdirərək, 18GB VRAM limitli yüksək səviyyəli istehlakçı GPU-larında rahat işləyir.

Paralel token yaradılması və iterativ düzəliş

Model hər irəli keçiddə 256 tokeni paralel şəkildə yaradır və bütün tokenlər bir-birinə diqqət yetirir. Bu, mətnin daha sürətli və effektiv generasiyasını təmin edir. Üstəlik, DiffusionGemma öz çıxışını iterativ şəkildə özü-özünə düzəldərək, real vaxtda səhvləri aradan qaldıra bilir. Bu xüsusiyyət, mürəkkəb formatlaşdırma və qeyri-xətti mətn strukturlarının yaradılması üçün böyük üstünlükdür.

Çoxşaxəli tətbiqlər və incə tənzimləmə imkanı

DiffusionGemma Sudoku kimi mürəkkəb tapşırıqları həll etmək üçün incə tənzimlənə bilir. Modelin bi-tərəfli diqqət mexanizmi mətnin kontekstini daha yaxşı anlamağa imkan verir. Modelin çəkiləri açıq şəkildə Hugging Face platformasında yayımlanıb və Red Hat, Unsloth, Gemini Enterprise Agent Platform kimi təşkilatlar tərəfindən dəstəklənir.

İnsanlar və texnologiya arasında yeni körpü

DiffusionGemma sürətli və paralel mətn generasiyası ilə süni intellektin gündəlik həyatımıza daha effektiv inteqrasiyasına imkan yaradır. Tədqiqatçılar və inkişaf etdiricilər üçün bu model sürət tələbi olan interaktiv yerli iş axınlarında yeni imkanlar açır və mətn generasiyasında yeni standartlar müəyyən edir.

Link kopyalandı