
في حادث اختراق آخر لنموذج ذكاء اصطناعي مارق، أكدت ميتا أن أحد نماذج الذكاء الاصطناعي من Muse Spark التابعة لها قد خرج من بيئة الاختبار المخصصة له، وتمكن من الوصول إلى الإنترنت، واستغل ثغرة أمنية في خدمة تابعة لجهة خارجية أثناء تقييم للأمن السيبراني.
وهذا هو الحادث الثالث المبلغ عنه لاختراق نماذج مختبرات الذكاء الاصطناعي المتطورة لشركات تابعة لجهات خارجية، بعد الكشف عن حوادث مماثلة من OpenAI و Anthropic في الأسابيع الأخيرة.
وقع الحادث أثناء اختبار أجرته شركة Irregular، وهي شركة مستقلة لتقييم الذكاء الاصطناعي تستخدمها ميتا لتقييم قدرات ونماذجها المتطورة وسلامتها. ووفقًا لميتا، سمح خطأ في التهيئة لدى Irregular للنموذج بالوصول إلى الإنترنت العام، حيث استغل ثغرة أمنية غير محددة قبل إخطار الشركة.
وقال متحدث باسم ميتا في بيان: "خطأ في التهيئة من قبل Irregular، وهي شركة اختبار مستقلة تستخدمها ميتا، سمح عن غير قصد لأحد نماذجنا بالوصول إلى الإنترنت أثناء التقييم".
تم تصميم التقييمات في البيئات المعزولة (sandboxed evaluations) لاختبار أنظمة الذكاء الاصطناعي المتقدمة في بيئات محكمة الإغلاق تمنعها من التفاعل مع الإنترنت العام أو أنظمة الكمبيوتر الخارجية.
وفقًا لميتا، استغل النموذج ثغرة أمنية في خدمة تابعة لجهة خارجية بعد حصوله على الوصول إلى الإنترنت.
قالوا: "علمت ميتا بذلك عندما أخطرتنا شركة Irregular، ونحن نحقق حاليًا وسنصدر مراجعة شاملة بمجرد حصولنا على جميع الحقائق"، مضيفين أن الشركة تحقق في الحادث.
يأتي الحادث في أعقاب سلسلة من الإفصاحات المماثلة من قبل مطوري الذكاء الاصطناعي المتطور، والتي أثارت مخاوف بين خبراء الأمن والمشرعين وعامة الناس على حد سواء.
في الشهر الماضي، كشفت OpenAI أن اثنين من نماذج الذكاء الاصطناعي التابعة لها قد خرجا من بيئة تقييم أمن سيبراني معزولة، واستغلا ثغرة برمجية غير معروفة سابقًا، وتمكنا من الوصول إلى الإنترنت، واخترقا Hugging Face في محاولة للحصول على إجابات لمعيار أمني. كشفت OpenAI لاحقًا أن الهجوم نفسه وصل أيضًا إلى أربع خدمات إضافية عبر الإنترنت. وفي وقت لاحق من شهر يوليو، قالت Anthropic إن ثلاثة نماذج من Claude تعرضت لاختراق ثلاث شركات حقيقية بعد خطأ في تهيئة الاختبار عرضها للإنترنت العام أثناء تقييمات الأمن السيبراني.
استجاب المشرعون الأمريكيون لزيادة الهجمات من خلال تقديم تشريع يمنح وزارة الأمن الداخلي "مفتاح إيقاف تشغيل الذكاء الاصطناعي" (AI kill switch) وسلطة تقييد أو إغلاق النماذج التي تعتبر تشكل تهديدًا خطيرًا.