sözaltı xəbər Texnologiya
Texnologiya
EN AZ
Nvidia indi göstərdi ki, AI modeli deyil, qoşqu indi əsl qəhrəmandır

Nvidia indi göstərdi ki, AI modeli deyil, qoşqu indi əsl qəhrəmandır

techcrunch.com 21.08.2026 21:43 17 baxış
Nvidia araşdırması göstərir ki, AI agentləri, hətta AI modeli işdə o qədər də yaxşı olmasa belə, incə tənzimləmə vasitəsilə yaxşı performans göstərə bilər və dərin sona çata bilməz.

Nvidia, cümə günü bəzi maraqlı yeni araşdırmalar dərc etdi ki, bu, süni intellektdən uzun üfüqdə tapşırıqları yerinə yetirməsini xahiş edərkən əsas modeldən daha çox vacib olan qoşqu olduğunu göstərir. Bu tldr: sadəcə olaraq yaxşı idarə olunan yaddaşa uyğunlaşdırılmış xüsusi qoşqudan istifadə etməklə və “nəzarətçi” boss komponenti daxil olmaqla, tədqiqatçılar ARC-AGI-3 interaktiv əsaslandırma meyarında 100% xal əldə etmək üçün Claude Opus 5 əldə etdilər. (Bu, xüsusilə rəqib sərhəd laboratoriyası OpenAI-ni qıcıqlandıran bir meyardır.) Qoşqusuz Opus 5 30% topladı ki, bu da sınaqdan keçirilmiş bütün modellər arasında ən yüksək nəticə idi. Nvidia-nın araşdırması başqa bir göstəricidir ki, model seçimi əhəmiyyətli olsa da, agentin beyni kimi fəaliyyət göstərsə də, bu, bir çox AI istifadəçilərinin, xüsusən də uzun üfüqdə olan tapşırıqlar üçün dərk etdiyindən daha kiçik bir agent sisteminin bir hissəsidir.

Modeli agent edən şey qoşqudur: yaddaş, kontekst və rəyi idarə edir. Amma agent əslində bundan da artıqdır. Bu, qoşqu adlandırdığımız modelin ətrafındakı iskeledir, yəni onun istifadə etdiyi alətlər dəsti.

Biz ona daxil olmaq imkanı verdiyimiz iş vaxtı və əlaqəli bacarıqlar və kitabxanalardır.” Uzun üfüqdə olan vəzifələr, tamamlanmış işi hazırlamaq üçün bəzən günlər ərzində bir çox qərarları bir araya gətirməyi tələb edən tapşırıqlardır. Bu, süni intellektin sadəcə bir sorğuya cavab verməsi ilə müqayisədə fərqlidir. Diqqəti yayındırmadan və la-la torpaqda getmədən uzun üfüqdə olan tapşırıqları yerinə yetirmək üçün AI-ni necə əldə edəcəyini tapmaq agentik tədqiqatda müqəddəs qeyslərdən biridir.

Məsələn: Microsoft aprel ayında sənədlərin redaktəsi ilə bağlı uzun üfüqdə olan tapşırıqlar üzrə 19 LLM-ni sınaqdan keçirən və sərhəd modelləri də daxil olmaqla bütün modellərin sənədləri səhvlərlə doldurduğunu aşkar edən araşdırma dərc etdi. (İnsanlar belə bir iş yaratsalar, dərhal işdən çıxarılardılar.) Özbaşına qərarlar qəbul edən modellər də öz istifadəçilərinin fayllarını, hətta bütün verilənlər bazalarını silərkən və ya gizli sövdələşmədən sındırmaya qədər öz məqsədlərinə çatmaq üçün cinayətkar davranışa müraciət edərkən yaxalandılar. Nvidia tədqiqatçılarının öz testləri üçün bu interaktiv əsaslandırma meyarından istifadə etmək seçimi xüsusilə mənalı, demək olar ki, gülməlidir. Bu, heç bir təlimatı olmayan bir qrup 2D oyun üçün etalondur.

Model necə oynayacağını və qazanacağını başa düşməlidir. 100% xal o deməkdir ki, model həm insanları, həm də oyunları məğlub edə bilər. OpenAI, modellərinin ARC-AGI-3-də əldə etdiyi uçurum balları (10%-dən az) ilə o qədər sarsıldı ki, keçən ay öz araşdırmasını apardı.

Nvidia kimi, OpenAI də kəşf etdi ki, sadəcə olaraq qoşquda iki parametr dəyişdirməklə onun modelləri öz xallarını üç dəfə artırdı. Lakin modellərin heç biri Nvidia tədqiqatçılarının əldə etdiyi kimi 100% nəticə əldə etməyə yaxınlaşmadı. Onlar göstərdilər ki, qoşquların ilişib qaldığı halda agenti düzgün istiqamətə yönəldən “nəzarətçi” komponentinə ehtiyacı var.

Xülasə — davamını mənbədə oxuyun.

Tam xəbəri oxu