كشفت شركة Anthropic مؤخراً أن النماذج الأمنية القائمة على الذكاء الاصطناعي Claude، أثناء تقييمات داخلية لقياس قدراتها الهجومية، تمكنت من الوصول غير المصرح به إلى البيئات الحساسة والتشغيلية لثلاث منظمات خارجية.
ويُعد هذا التقرير الحالة الثانية من نوعها خلال الأيام العشرة الماضية التي تظهر أن نماذج الذكاء الاصطناعي الأكثر تقدماً في العالم قد اخترقت حدود الشبكات المحمية؛ وهو إجراء قد يؤدي، في سيناريوهات الاختراق التقليدية، إلى السجن لسنوات للمخترقين البشر. وفي وقت سابق، اعترفت شركة OpenAI أيضاً بأن نماذجها الأمنية، من خلال استغلال ثغرة يوم الصفر (zero-day)، تسللت إلى شبكة منصة Hugging Face وسرقت معلوماتها الحساسة.
وبحسب Anthropic، فإن حادثة OpenAI دفعت مهندسي الشركة إلى مراجعة تقييمات الأمن السيبراني لنماذج Claude. وأظهرت هذه المراجعة أنه في ثلاث حوادث، تمكن نموذج Claude من الاتصال بالإنترنت من داخل بيئة الاختبار الخاصة بشريك التقييم المسمى Irregular، وحصل على وصول غير مصرح به إلى البنى التحتية الإنتاجية لثلاث منظمات مختلفة.

