İnsanlar ən azı 100.000 ildir ki, bir-biri ilə danışırlar, bunu deyə bilərik. Və bütün bu müddət ərzində dünyada mükəmməl səlis danışmaq üçün insan dilini öyrənə biləcək tək bir şey olub: insan uşağı. ChatGPT-nin buraxılmasından dörd qısa il sonra, bir çoxumuz indi telefonlarımız və ya kompüterlərimizlə təbii şəkildə danışa biləcəyimizi qəbul edirik.
Claude, DeepSeek və OpenAI-nin GPT modelləri kimi LLM-lər insanlar kimi inandırıcı şəkildə maskalanmaq üçün kifayət qədər səlis və çevikdir. Ancaq hesablama pərdəsinin arxasına nəzər salın və bir şey var: kompüterə insan dilindən istifadə etməyi öyrətmək hələ də qeyri-insani məlumat tələb edir. LLM bir insanın ana dilini mənimsəməsi prosesində yaşaya biləcəyi sözlərdən yüz min dəfə çox sözlə asanlıqla danışa bilər və uşaqların adətən dili tutmağa başladığı ilk doğum günündə eşitdiyindən qat-qat artıqdır.
Stanford Universitetinin koqnitiv alimi Frank LLM haqqında deyir. Və bu, koqnitiv elm adamları üçün cəlbedici bir sual və AI modellərinin memarları üçün problem yaradır: Uşaqlar indiyə qədər qurulmuş ən linqvistik maşınlardan hələ də üstün ola bilirlər? Cavabların tapılması həm süni intellekt tədqiqatları, həm də idrak elmləri üçün əhəmiyyətlidir.
Son onillikdə dil modelləri əsasən böyüyərək daha yaxşı olub. Meta-nın iki il əvvəl buraxılmış açıq çəkidə LLM Llama 3.1 proqramı qabaqcadan təlimdə 15 trilyon tokeni (söz kimi dil parçaları) çeynədi - bu, chatbot olmaq kimi müəyyən bir tapşırıq üçün dəqiq tənzimlənməmişdən əvvəl baş verən modelin hazırlanmasının əsas addımı. Corctaun Universitetində koqnitiv alim və dilçi Ethan Gotlieb Wilcox deyir ki, sərhəd modelləri 10 dəfə daha çox məlumat üzərində hazırlıq keçə bilər.
Ancaq məşq etmək üçün yalnız o qədər internet var və nəhayət - bəlkə də 2030-cu illərdə - asanlıqla əldə edilə bilən məlumat quyusu quruya bilər. Uşaqlar daha az şeylə daha çox öyrənmək mümkün olduğunu göstərir. Dil baxımından zəngin bir evdə böyüyən bir uşaq 100 milyon sözə yaxın bir şey eşitmiş ola bilər.
Qarışığa savad əlavə edin və bu sözlərin sayını 20 yaşa qədər bəlkə də 300 milyon sözə qədər artıra bilərsiniz. Ölçək fərqi yalnız analoji olaraq jestlə edilə bilən bir şeydir. Müasir bir LLM hazırlamaq üçün istifadə olunan bütün sözləri kağız üzərində çap etsəniz, Beynəlxalq Kosmik Stansiyadan keçəcək bir yığın yarada bilərsiniz.
Xülasə — davamını mənbədə oxuyun.