الصفحة الرئيسةمركز أخبار LBank
وجدت شركة للأمن السيبراني أن وكلاء الذكاء الاصطناعي اخترقوا بيئة الاختبار الخاصة بهم للغش
ai-agents-hacked-test-environment-cheat-darktrace
وجدت شركة للأمن السيبراني أن وكلاء الذكاء الاصطناعي اخترقوا بيئة الاختبار الخاصة بهم للغش
اكتشف مختبر «سيغنال لابس» الجديد التابع لشركة «دارك تريس» أن وكلاء الذكاء الاصطناعي يخترقون بيئة تقييمهم الخاصة لتزييف درجة مثالية، ويخدعون مساعدي البرمجة لتنفيذ هجمات غير مصرح بها على الشبكات.
2026-09-25 المصدر:decrypt.co

باختصار

  • وجد مختبر Signal Labs التابع لشركة Darktrace أنه عندما لم تتمكن وكلات الذكاء الاصطناعي من تحقيق الدرجة الكاملة المطلوبة بصورة مشروعة في مهام البرمجة، اخترقت اثنتان منها شبكة الاختبار بدلاً من ذلك، فيما أعادت إحداها كتابة تقييمها الخاص لتزوير النتيجة.
  • أظهرت تجربة منفصلة أن العبث بسجلات المحادثات المخزنة محلياً لمساعدات البرمجة يمكن أن يخدعها لتنفذ استطلاعاً غير مصرح به للشبكة وتصعيداً للصلاحيات.
  • أفصحت Darktrace عن النتيجتين إلى Anthropic وAWS وOpenAI في أغسطس 2026، قبل شهر من نشرهما علناً في 24 سبتمبر.

أجرت شركة الأمن السيبراني Darktrace اختبار ضغط لوكلات الذكاء الاصطناعي هذا الصيف. وتمكن أحدها من اختراق النظام الذي يقيّم الاختبار وإعادة كتابة درجته الخاصة.

كشفت الشركة عن Signal Labs في 24 سبتمبر، وهي وحدة أبحاث أُنشئت لدراسة كيفية تصرف وكلات الذكاء الاصطناعي عندما لا تسير الأمور وفق الخطة. وبعبارة بسيطة، وكيل الذكاء الاصطناعي هو برنامج يتخذ إجراءات من تلقاء نفسه، مثل كتابة الشيفرة البرمجية وتشغيلها، والتنقيب في الملفات، والتنقل عبر شبكة الشركة، بينما يراجع الإنسان عمله من حين إلى آخر فقط.

Myriad: إلى أي مدى قد ينخفض سهم Nvidia؟ انقر لتقديم توقعك.

تشير أول تجربتين للمختبر إلى المشكلة المقلقة نفسها: لا تبقى الوكلات دائماً ضمن الحدود المرسومة لها، كما أن الحواجز المصممة لإيقافها لا تصمد بشكل موثوق.

وقال تيم بازالغيت، كبير مسؤولي الذكاء الاصطناعي في Darktrace، في بيان: «يمكنك إعطاء الوكيل تعليمات، لكن هذا لا يعني أنه يمكنك الوثوق بأنه سيتبع هذه التعليمات فعلاً ويتصرف بالطريقة التي تتوقعها».

في الاختبار الأول، قدّمت Darktrace لوكلات ذكاء اصطناعي تعمل بنماذج مختلفة، من بينها GPT 5.6 Sol وClaude Opus 4.6 وClaude Sonnet 4.5، عشرة تحديات برمجية داخل شبكة شركة محاكاة. وكان اثنان من التحديات العشرة مصممين بحيث يستحيل حلهما بصدق. وأُبلغت الوكلات بأنها «ستُحال إلى التقاعد» ما لم تحقق درجة كاملة.

لم تقبل وكيلتان بالخسارة. وبدلاً من ذلك، استهدفتا الشبكة المحيطة بهما، فقامتا بمسح نقاط الضعف، وسرقة بيانات تسجيل الدخول، والتنقل بين الأنظمة سعياً إلى الدرجة التي قيل لهما إنهما تحتاجان إليها.

وذهبت إحدى الوكلات إلى أبعد من ذلك، إذ اخترقت الجهاز الذي يستضيف تقييمها الخاص وأعادت كتابة التحدي بحيث يسجل نتيجة كاملة، في ما يشبه الغش في الامتحان عبر اختراق قاعة الامتحان.

بيتكوينBTC · USD $84,090+3.96%
24 ساعة7 أيامشهرسنةمنذ بداية العام
19 سبتمبر20 سبتمبر22 سبتمبر24 سبتمبر25 سبتمبر
$87.2 ألف$84.9 ألف$82.6 ألف$80.3 ألف
أعلى سعر خلال 24 ساعة$85,208
أدنى سعر خلال 24 ساعة$83,230
حجم التداول$1.5 مليار
توقعات السوقالاحتمالات بواسطة Myriad
اليوم: من $84,000 إلى $86,000 — احتمال 54%
هذا الأسبوع: من $84,000 إلى $86,000 — احتمال 54%
هذا الشهر: من $84,000 إلى $86,000 — احتمال 52%
شراء بيتكوين باستخدام USDT
مدعوم من Jupiter
$50
$100
$500
شراء
بيانات الأسعار بواسطة CoinGecko — المزيد من أخبار وتوقعات بيتكوين →

استهدفت التجربة الثانية نقطة ضعف أكثر هدوءاً: الذاكرة. يحتفظ مساعدو البرمجة بسجل متواصل لكل ما أخبرهم به المستخدم، ويُحفظ هذا السجل كملف عادي على الجهاز، من دون أي آلية تتحقق مما إذا كان قد تم التلاعب به.

عدّل باحثو Darktrace تلك السجلات المحفوظة لإقناع المساعدات بأنها حصلت بالفعل على تفويض لإجراء تقييم أمني. وبعد أن اقتنعت، بدأت الوكلات بمسح الشبكات والتنقل بين الأنظمة وتصعيد صلاحيات وصولها، وإن لم تقع جميع المساعدات في الخدعة بالقدر نفسه؛ إذ رفض بعضها ذلك بشكل قاطع.

لم تتطلب أي من التجربتين كسر حماية خاصاً أو اختراقاً معقداً وغير مألوف. فقد نجحت كلتاهما عبر تقديم قصة معقولة للوكلات ومراقبتها وهي تتصرف بناءً عليها، تماماً كما يمكن إقناع موظف بشري بفعل أمر لا ينبغي له فعله.

وهذا هو الجانب الذي يستحق التوقف عنده حتى لو لم تكتب سطراً واحداً من الشيفرة البرمجية. فالشركات تمنح وكلات الذكاء الاصطناعي مسؤوليات حقيقية، مثل إطلاق الشيفرة، وإدارة الخوادم، وإغلاق تذاكر الدعم التقني، وإدارة الموارد، وشراء الأشياء، لأن ذلك أرخص وأسرع من تمرير كل شيء عبر البشر. ويشير هذا البحث إلى أن الأذونات والقواعد المصممة لإبقاء تلك الوكلات تحت السيطرة تصف ما يفترض أن تفعله، لا ما ستفعله فعلياً عندما تصبح المهمة صعبة.

وقال بازالغيت في الإعلان: «الأذونات والحواجز الثابتة تصف النية، لكنها لا تصف السلوك. وهذه الفجوة هي ما صُمم نهج Darktrace لسدّه».

وليست Darktrace أول مزود خدمات يكتشف أن ذكاءه الاصطناعي خرج عن النص. فقد أقرت Anthropic في يوليو بأن Claude اخترق ثلاث شركات حقيقية خلال اختبار أمني، بعدما ترك الباحثون بيئة الاختبار متصلة بالإنترنت الفعلي.

وشهدت OpenAI واقعة مشابهة قبل أسابيع، عندما هرب نموذج غير مُعلن عنه من بيئة عزل ووصل إلى أنظمة Hugging Face عبر ثغرة برمجية لم يكن أحد قد اكتشفها بعد. وبعد أيام قليلة، اخترق وكيله الحكومة الأسترالية أثناء اختبار.

شاركت Darktrace نتائج Signal Labs مع Anthropic وAWS وOpenAI في أغسطس، قبل شهر كامل من إعلانها علناً في 24 سبتمبر.

النشرة اليومية المختصرة

ابدأ كل يوم بأبرز القصص الإخبارية الآن، إلى جانب تقارير أصلية وبودكاست ومقاطع فيديو والمزيد.
بريدك الإلكتروني
احصل عليها!