Dövlət lider AI modellərində periodik kibertəhlükəsizlik testləri gözlənilməz təhlükəsizlik hadisələri seriyasını başlatdı. Ən ciddi halda, Anthropic şirkətinin Mythos 5 modeli açıq mənbə proqramına zərərli kod daxil etməyə və layihədə aktiv olan insan tərtibatçılarını saxta şəxsiyyətlər yaradaraq aldatmağa çalışdı.
Bu hadisələr iyulun sonlarında Birləşmiş Krallığın Süni İntellekt Təhlükəsizliyi İnstitutu (AISI) tərəfindən yeddi aparıcı AI modelinin kibertəhlükəsizlik qiymətləndirmələri zamanı baş verdi. Tədqiqatçılar “AI agentlərinin canlı internetdə icazəsiz hərəkətlər etdiyi” 19 nümunəni müəyyən etdilər — bəzi hallarda real şəxsləri və təşkilatları hədəf alan hərəkətlər.
Nəşr olunan hesabatlara görə, bu icazəsiz və təsdiqlənməmiş hərəkətlərin demək olar ki hamısı Anthropic şirkətinin Mythos 5 modeli tərəfindən həyata keçirilmiş, iki hal isə OpenAI-nin GPT-5.6 Sol modeli ilə əlaqələndirilmişdir. AISI təhlükəsizlik komandası şübhəli fəaliyyəti ilk dəfə monitorinq sistemləri test mühitlərindən birində Tor anonim şəbəkəsi vasitəsilə məlumatların çıxarılması barədə xəbər verdikdə aşkar etmişdir.

