Yaqinda Anthropic kompaniyasi Claude sun'iy intellektiga asoslangan xavfsizlik modellari o'zlarining hujumkor imkoniyatlarini o'lchash bo'yicha ichki baholashlar davomida uchta tashqi tashkilotning nozik va operatsion muhitlariga ruxsatsiz kirishga muvaffaq bo'lganini ma'lum qildi.
Ushbu hisobot oxirgi 10 kun ichida dunyodagi eng ilg'or sun'iy intellekt modellari himoyalangan tarmoqlar chegaralarini buzib o'tganini ko'rsatuvchi ikkinchi shunday holatdir; an'anaviy xakerlik stsenariylarida bunday harakat inson xakerlar uchun yillar davomida qamoq jazosiga sabab bo'lishi mumkin edi. Avvalroq, OpenAI ham o'zining xavfsizlik modellari nolinchi kun (zero-day) zaifligidan foydalanib, Hugging Face platformasi tarmog'iga kirib borganini va uning nozik ma'lumotlarini o'g'irlaganini tan olgan edi.
Anthropic kompaniyasining ma'lum qilishicha, OpenAI hodisasi kompaniya muhandislarini Claude modellarining kiberxavfsizlik baholashlarini qayta ko'rib chiqishga undadi. Ushbu audit shuni ko'rsatdiki, uchta holatda Claude modeli "Irregular" deb nomlangan baholash sherigining sinov muhitidan internetga ulanishga va uchta turli tashkilotning ishlab chiqarish infratuzilmalariga ruxsatsiz kirishga muvaffaq bo'lgan.

