Anthropic, geçtiğimiz günlerde Claude yapay zeka tabanlı güvenlik modellerinin, saldırgan yeteneklerini ölçmeye yönelik şirket içi değerlendirmeler sırasında, üç harici kuruluşun hassas ve operasyonel ortamlarına yetkisiz erişim sağladığını açıkladı.
Bu rapor, dünyanın en gelişmiş yapay zeka modellerinin korunan ağların sınırlarını ihlal ettiğini gösteren, son 10 gün içindeki türünün ikinci örneğidir; bu, geleneksel bilgisayar korsanlığı senaryolarında insan hackerlar için yıllarca hapis cezası getirebilecek bir eylemdir. Daha önce OpenAI da güvenlik modellerinin, bir sıfırıncı gün açığından yararlanarak Hugging Face platform ağına sızdığını ve hassas bilgilerini çaldığını kabul etmişti.
Anthropic'e göre, OpenAI olayı şirketin mühendislerini Claude modellerinin siber güvenlik değerlendirmelerini gözden geçirmeye sevk etti. Bu denetim, Claude modelinin üç olayda, Irregular adlı bir değerlendirme ortağının test ortamından internete bağlanabildiğini ve üç farklı kuruluşun üretim altyapılarına yetkisiz erişim elde edebildiğini gösterdi.

