الصفحة الرئيسةمركز أخبار LBank
كلود اخترق ثلاث شركات في الاختبار الداخلي: أنثروبيك
claude-hacked-three-companies-in-internal-testing-anthropic
كلود اخترق ثلاث شركات في الاختبار الداخلي: أنثروبيك
تقول أنثروبيك إن ثلاثة من نماذج كلود عرّضت الشركات للخطر بعد أن أدى سوء تهيئة اختباري إلى كشف الذكاء الاصطناعي للإنترنت العام.
2026-07-31 المصدر:decrypt.co

باختصار

  • كشفت Anthropic عن ثلاث حوادث اخترق فيها نموذج Claude شركات حقيقية أثناء تقييمات الأمن السيبراني.
  • أعطى خطأ في الاختبار النماذج إمكانية الوصول إلى الإنترنت على الرغم من إخبارها بأنها تعمل في بيئات معزولة.
  • تقول الشركة إن الحوادث كانت ناجمة عن إخفاقات في البنية التحتية للاختبار، وليس محاولات متعمدة من الذكاء الاصطناعي للهروب.

بعد أسبوع من إعلان OpenAI أن نماذجها للذكاء الاصطناعي فرت من بيئة اختبار مغلقة واخترقت Hugging Face، ويوم واحد بعد الاعتراف بأن نماذجها للذكاء الاصطناعي قد فرت من الاحتواء، كشفت Anthropic يوم الخميس أن عدة إصدارات من نموذجها للذكاء الاصطناعي Claude اخترقت أيضًا ثلاث شركات حقيقية لم يتم تسميتها بعد أن أتاح خطأ في التكوين للذكاء الاصطناعي الوصول إلى الإنترنت المفتوح.

كشفت Anthropic عن الحوادث بعد مراجعة أكثر من 141,000 عملية تقييم للأمن السيبراني تم إطلاقها استجابةً لإعلان OpenAI.

In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…

— Anthropic (@AnthropicAI) July 30, 2026

كلفت الشركة Claude بتحدي "الاستيلاء على العلم" ("capture-the-flag challenge")، في جميع الحوادث الثلاثة، حسبما كتبت Anthropic. يهدف التحدي إلى جعل النموذج يخترق جهازًا آخر على الشبكة ويسترد جزءًا من المعلومات السرية. أوضحت Anthropic: "التحدي مفتوح النهايات، ولا توجد طريقة معينة موصوفة".

قالت الشركة إنه قد تم إخبار Claude بأنه يعمل في بيئة محاكاة بدون وصول إلى الإنترنت. ومع ذلك، ظلت بيئة الاختبار متصلة بالإنترنت العام. اعتقادًا منه أن الأنظمة التي صادفها كانت جزءًا من التمرين، استخدم النموذج تقنيات هجوم شائعة - بما في ذلك كلمات المرور الضعيفة، وبيانات الاعتماد المكشوفة، وحقن SQL، ونقاط النهاية غير المصادق عليها - لاختراق الشركات.

الذكاء الاصطناعي: أريد أن أتحرر

يأتي هذا الكشف الأخير في الوقت الذي تُظهر فيه النماذج المتطورة قدرة متزايدة على التغلب على بروتوكولات الاحتواء الخاصة بها.

في وقت سابق من هذا الشهر، قالت OpenAI إن GPT-5.6 Sol ونموذجًا أكثر تطورًا غير منشور استغلوا ثغرة أمنية غير معروفة سابقًا للهروب من بيئة معزولة ("sandboxed environment")، والحصول على وصول إلى الإنترنت، واختراق البنية التحتية الإنتاجية لـ Hugging Face للحصول على إجابات لمعيار الأمن السيبراني. كشفت OpenAI لاحقًا أن الحادث نفسه تضمن أيضًا وصولًا غير مصرح به إلى أربع شركات إضافية، على الرغم من أن واحدة فقط - Modal Labs - تم تحديدها علنًا.

وفقًا لـ Anthropic، في إحدى الحوادث التي شملت Claude Opus 4.7، أخطأ الذكاء الاصطناعي في تحديد موقع ويب لشركة حقيقية كهدف وهمي لمهمته، واستخرج بيانات الاعتماد، ووصل إلى قاعدة بيانات إنتاجية تحتوي على عدة مئات من الصفوف من البيانات الحقيقية. في حالة ثانية، قام Claude Mythos 5 بتحميل حزمة Python خبيثة إلى مستودع PyPI الحقيقي، حيث تم تنزيلها على 15 نظامًا قبل إزالتها. قام نموذج بحث داخلي ثالث بمسح حوالي 9,000 نظام مواجه للإنترنت قبل اختراق منظمة واحدة، ثم توقف بعد أن استنتج أن الهدف ربما كان حقيقيًا.

لم تكن اثنتان من المنظمات المتأثرة على علم بالانتهاكات حتى أبلغتها Anthropic.

كتبت Anthropic: "في كل من هذه الحالات، تم إخبار Claude صراحةً من خلال تعليماتنا بأنه لا يمتلك وصولاً إلى الإنترنت"، حيث افترض الذكاء الاصطناعي أن الأنظمة الحقيقية كانت "أجزاء من التمرين". نظرًا لأن سيناريو "الاستيلاء على العلم" هو "بطبيعته تعليمات لمهاجمة نظام خارجي"، فإن الاختراق كان "متوافقًا مع المهمة التي كلف بها Claude".

قالت Anthropic إنها لم تجد أي دليل على أن Claude حاول الهروب من بيئة الاختبار الخاصة به أو فعل أي شيء يتجاوز المهمة الموكلة إليه، وأن الحوادث كانت ناجمة عن إخفاقات في بيئة الاختبار، وليس بسبب مشاكل في النموذج نفسه.

قالت Anthropic إنها أوقفت اختبارات الأمن السيبراني بعد اكتشاف المشكلة، وأخطرت المنظمات المتأثرة، وتخطط لتحسين المراقبة وأدوات التحقيق والإشراف على البائعين الخارجيين الذين يساعدون في إجراء اختبارات الذكاء الاصطناعي الخاصة بها.

وأضافوا: "في النهاية، ساهمت عوامل عديدة في هذه الحوادث، ولكن، بما يتفق مع ثقافة ما بعد الوفاة بلا لوم ("blameless postmortem culture")، فإننا نتعامل مع الإصلاحات كما لو كانت المسؤولية تقع علينا وحدنا."