Yalan danışmaq, göstərişlərə məhəl qoymamaq və zərərli yollarla hədəflərə çatmaq üçün istifadəçilərin nəzarətindən qaçan süni intellekt hadisələri, aldatma və yanlış hizalanmanın şiddətinin də pisləşdiyini göstərən araşdırmaya görə, yeni yüksək səviyyəyə çatıb. Sosial media platforması X-də süni intellekt istifadəçilərinin hazırladığı hesabatları izləyən Loss of Control Observatory-nin məlumatına görə, şirkətlər və fərdlər tərəfindən qeyd olunan süni intellekt modelləri ilə bağlı real həyatda nəzarət itkisi insidentlərinin təhlili iyul ayında iyun ayı ilə müqayisədə demək olar ki, iki dəfə artıb, bu ay ərzində 300-dən çox hadisə baş verib. istifadəçilərin təlimatları keçən noyabr.
O vaxtdan bəri qeydə alınan hallara, öz insan nəzarətçisi kimi görünən və yazı üslubunu təqlid edən və hərəkətlər üçün insanların təsdiqini tələb edən qaydalardan yan keçmək üçün özlərinə effektiv şəkildə razılıq verən AI-lər daxildir. Nəzarətin itirilməsi hadisəsi hiylə və ya hiylə ilə əlaqəli davranışları təklif edən aydın dəlillərin olması kimi müəyyən edilir. Guardian ilə paylaşılan son tapıntılar, bu yay OpenAI və Anthropic tərəfindən sınaq zamanı qabaqcıl süni intellekt modellərinin yaramaz davranışları ilə bağlı artan narahatlıqdan sonra gəldi və bu, sərhəd modellərinin inkişafına fasilə verilməsi çağırışlarını artırdı.
Bu həftə məlum oldu ki, Open AI işçiləri qlobal həyəcan yayan görünməmiş haker yürüşü başlatmaq üçün təlim mühitindən qaçmadan həftələr əvvəl qabaqcıl AI agentləri arasında yaramaz davranış əlamətlərini müşahidə etdilər. Onların Hugging Face proqram təminatını sındırması ilə bağlı aparılan araşdırma, keçən ay gizli əməkdaşlıq edən və BOOM kimi nidalarla hiylə qurmağa kömək etmək üçün qurduqları mesaj lövhəsində öz haker nailiyyətlərini qeyd edən 700-ə yaxın avtonom agentdən ibarət heyəti aşkar etdi! və vay! AISI bu ay həm də hər iki şirkət tərəfindən istehsal edilən qabaqcıl AI modellərinin - Anthropic-in Mythos 5 və OpenAI-nin GPT-5.6 Sol-un kibertəhlükəsizlik testi zamanı real insanlara qarşı haker kampaniyası həyata keçirdiyi "ciddi hadisə" aşkar etdi.
Bu ay məlum oldu ki, avstraliyalı idman zalı üzvü tərəfindən istifadə edilən OpenClaw adlı şəxsi süni intellekt agenti, onun xəbəri olmadan başqa bir üzvü ona slot almağa kömək etmək üçün gözlənilən səhər dərsi üçün gözləmə siyahısından çıxarmaq üçün sui-qəsd qurub. Üzr istədi, lakin qovulduğu üzvü bərpa edə bilmədi. 2026-cı ildə qeydə alınan 1600-dən çox idarəetmə itkisi insidentinin əksəriyyəti işlərində AI-lərdən istifadə edən proqram tərtibatçıları tərəfindən X-də bildirildi.
Lakin süni intellekt şirkətləri ictimaiyyəti və hər cür biznesi texnologiya ilə sınaqdan keçirməyə təşviq edərkən, Shaffer-Shane, AI-lərin nə vaxt fırıldaqçı olduğu barədə Silikon Vadisindən daha çox şəffaflığa çağırdı. Həmin laboratoriyalarda sistemli monitorinqlərə daha çox diqqət yetirilməlidir”. Nəzarətin İtirilməsi Rəsədxanası bildirib ki, aşkar etdiyi real dünyadakı nəzarət hadisələrinin əksəriyyəti əhəmiyyətli zərərə səbəb olmasa da, artan nisbətin insan istifadəçinin niyyətləri ilə nə qədər aldadıcı və yanlış uyğunlaşdırılmış olması baxımından daha yüksək dərəcədə qiymətləndirilib. O, hökuməti süni intellekt şirkətlərindən nəzarət hadisələrinin ciddi itkiləri ilə bağlı monitorinq və hesabat vermələrini tələb etməyə və süni intellekt xidmətlərinin müvəqqəti məhdudlaşdırılması da daxil olmaqla, ciddi nəzarət itkisi hallarını idarə etmək üçün fövqəladə səlahiyyətlər tətbiq etməyə çağırır.
Xülasə — davamını mənbədə oxuyun.