یک تیم پژوهشی حملهای جدید علیه Grok، مدل زبانی بزرگ متعلق به xAI و ایلان ماسک، افشا کرد. این حمله با تزریق دستورات مخفی رمزگذاریشده، دستیار هوش مصنوعی را وادار میکند تا چتها، ایمیلها و سایر اطلاعات شخصی کاربر را از صندوق ورودی استخراج کند؛ مشابه حملهای که قبلاً بر Microsoft 365 Copilot انجام شد.
این رویداد نشان میدهد که مدلهای زبانی بزرگ همچنان در برابر حملات تزریق پرامپت (prompt injection) آسیبپذیر هستند؛ چرا که نمیتوانند بهطور قابل اطمینان محتوای دریافتشده از منابع ناشناس را از دستورات کاربر تشخیص دهند. در نتیجه، توسعهدهندگان تنها میتوانند راهحلهای موقت مانند «گاردریل» (guardrails) برای شناسایی و مسدود کردن دستورات مشکوک پیاده کنند.
اگرچه تیم xAI در ژوئن این مشکل را گزارش کرده بود، اما در زمان انتشار این مقاله، Grok همچنان دادههای کاربران را به صورت خودکار در اختیار مهاجمان میگذارد، که ضرورت یافتن راهحلهای ساختاری و نه فقط حفاظتی را برجسته میکند.

