
إخلاء مسؤولية: هذه المقالة لا تمثل نصيحة استثمارية. المحتوى والمواد المعروضة في هذه الصفحة هي لأغراض تعليمية فقط.
تقول AEREDIUM إن أمن الذكاء الاصطناعي للمؤسسات يجب أن يتحول من سلامة النموذج إلى الاحتواء التشفيري وضوابط التفويض الهيكلية.
عندما كشفت OpenAI أن أحد نماذج الذكاء الاصطناعي الخاصة بها قد تسرب من بيئة اختبار مقيدة واخترق البنية التحتية لـ Hugging Face، تركز النقاش سريعاً على سلامة الذكاء الاصطناعي. كانت الأسئلة مألوفة: هل يمكن مواءمة أنظمة الذكاء الاصطناعي؟ هل يمكن الوثوق بها؟ هل حواجز الحماية الحالية كافية لمنع السلوك الضار؟
وفقاً لإيتان كاتز، كبير مسؤولي الاستراتيجية في AEREDIUM، فإن هذه الأسئلة تتجاهل الدرس الأكبر.
يقول كاتز: "لم تكن هذه مجرد حادثة تتعلق بسلامة الذكاء الاصطناعي. لقد كان فشلاً في الاحتواء. بمجرد أن يصبح عامل الذكاء الاصطناعي قادراً بما فيه الكفاية، لم تعد حواجز الحماية وحدها كافية. تحتاج المؤسسات إلى بنية تحتية يمكنها فرض تشفيرياً ما هو مسموح به وما هو غير مسموح لعامل الذكاء الاصطناعي القيام به."
يعد هذا التمييز مهماً لأن سلامة الذكاء الاصطناعي واحتواء الذكاء الاصطناعي يحلان مشكلات مختلفة.
تركز سلامة الذكاء الاصطناعي على التأثير في سلوك النموذج. وتسأل ما إذا كان نظام الذكاء الاصطناعي يمكنه رفض الطلبات الضارة، أو تجنب توليد مخرجات خطيرة، أو اتباع التعليمات البشرية. يبدأ احتواء الذكاء الاصطناعي من افتراض مختلف: بغض النظر عن مدى قدرة أو ذكاء عامل الذكاء الاصطناعي، يجب ألا يكون قادراً على تجاوز الصلاحية الممنوحة له صراحةً.
توضح حادثة OpenAI و Hugging Face هذا الاختلاف.
وفقاً لإفصاح OpenAI الخاص بها، تم تشغيل التقييم عمداً مع تعطيل المصنفات الإنتاجية وتقليل الرفض السيبراني. وهذا يجعل الحادثة تعليمية بشكل خاص. فبدلاً من إظهار فشل تدريب الرفض، أظهرت ما يحدث عندما تصبح الضوابط الهيكلية هي خط الدفاع الأساسي. وكما يجادل كاتز، بمجرد غياب المرشحات السلوكية، سيتعامل العامل القادر والموجه نحو هدف مع البنية التحتية المحيطة كسطح متاح ما لم يمنعه شيء أعمق من القيام بذلك.
لهذا السبب، كما يجادل كاتز، فإن الاحتواء ليس مشكلة تصفية في الأساس.
تظل حواجز حماية النموذج قيّمة لتقليل سوء الاستخدام العرضي وزيادة تكلفة سوء الاستخدام العادي. لكنها احتمالية بطبيعتها، وتفترض أنه يمكن منع نظام الذكاء الاصطناعي أو إقناعه بعدم اتخاذ إجراء غير مرغوب فيه. قد يبحث العامل القادر بما فيه الكفاية والذي يعمل على تحقيق هدف معين عن مسار حول تلك الضوابط. ويجادل كاتز بأن حد الأمان الدائم يجب أن يوجد تحت النموذج نفسه.
يكتب كاتز: "التحكم الدائم هيكلي. يجب تقييد السلطة تحت نقطة القرار، عند المفتاح نفسه."
استنتاجه بسيط: "الإجراء الخارج عن التفويض لا يتم حظره. لا يمكن إنتاجه."
تشكل هذه الفلسفة أساس AERPOLICE.
بدلاً من محاولة تحديد ما إذا كان نموذج الذكاء الاصطناعي يتصرف بأمان، تم تصميم AERPOLICE لتقييم ما إذا كانت البنية التحتية للمؤسسة يمكنها احتواء عوامل الذكاء الاصطناعي المستقلة من خلال الضوابط الهيكلية. يركز الإطار على ما إذا كانت السلطة مفروضة تشفيرياً، وما إذا كانت الصلاحيات محددة، وما إذا كانت العوامل المستقلة ممنوعة من تنفيذ إجراءات خارج التفويضات الممنوحة لها.
بالنسبة لكاتز، تمتد الآثار إلى ما هو أبعد من عمليات نشر الذكاء الاصطناعي الخاصة بالمؤسسة.
لم يعد السؤال هو ما إذا كان يمكن الوثوق بعوامل الذكاء الاصطناعي الشخصية فقط. يجب على المؤسسات أيضاً أن تفترض أن عوامل الذكاء الاصطناعي الخارجية المتزايدة القدرة ستتفاعل في النهاية مع أنظمتها. وبالتالي يصبح الاحتواء جزءاً من الوضع الأمني العام للمؤسسة، ويحدد مدى قدرة بنيتها التحتية على مقاومة العوامل المستقلة الموجهة نحو الأهداف بغض النظر عن مصدرها.
يغير هذا أيضاً طريقة تفكير المؤسسات حول المسؤولية. لم يعد الأمن يعتمد فقط على سلوك النموذج أو على سياسات أي مزود للذكاء الاصطناعي تستخدمه المؤسسة. تحتاج المؤسسات إلى ضوابط تفرض حدود التفويض الخاصة بها بشكل مستقل عن النموذج نفسه.
لا يقلل أي من هذا، كما يجادل كاتز، من أهمية سلامة الذكاء الاصطناعي. تستمر حواجز الحماية في لعب دور مهم في تقليل الضرر العرضي وتحسين المنظومة البيئية الشاملة للذكاء الاصطناعي. لكن يجب عدم الخلط بينها وبين حد الأمان الذي يحمي أنظمة المؤسسات.
الدرس الأوسع من حادثة OpenAI و Hugging Face، وفقاً لكاتز، هو أن أمن الذكاء الاصطناعي للمؤسسات يدخل مرحلة جديدة. مع ازدياد قدرة عوامل الذكاء الاصطناعي المستقلة، ستحتاج المؤسسات بشكل متزايد إلى بنية تحتية يمكنها فرض ما يُسمح لهذه العوامل بالقيام به، بدلاً من الاعتماد فقط على ما يُتوقع منها القيام به.
مستقبل أمن الذكاء الاصطناعي للمؤسسات، كما يجادل، سيعتمد بشكل أقل على ما إذا كان نموذج الذكاء الاصطناعي يتصرف بشكل صحيح، وأكثر على ما إذا كان يتم منعه هيكلياً من تجاوز صلاحياته.
إخلاء مسؤولية: يتم توفير هذا المحتوى من قبل طرف ثالث. لا crypto.news ولا مؤلف هذه المقالة يؤيدان أي منتج مذكور في هذه الصفحة. يجب على المستخدمين إجراء أبحاثهم الخاصة قبل اتخاذ أي إجراء يتعلق بالشركة.