الصفحة الرئيسةمركز أخبار LBank
حاول الباحثون تمكين الذكاء الاصطناعي من ممارسة البحث العلمي. وقد فشل.
researchers-tried-letting-ai-do-science-it-failed
حاول الباحثون تمكين الذكاء الاصطناعي من ممارسة البحث العلمي. وقد فشل.
كشفت دراسة أجرتها عدة مؤسسات أن وكلاء الذكاء الاصطناعي المتطورة حاليًا بإمكانها أداء الجوانب الميكانيكية للبحث، لكنها أخفقت في إنتاج أعمال أصلية تستحق القبول في مؤتمرات الذكاء الاصطناعي الكبرى.
2026-07-30 المصدر:decrypt.co

باختصار

  • اختبر الباحثون ما إذا كان بإمكان وكلاء الذكاء الاصطناعي الرواد إجراء أبحاث الذكاء الاصطناعي بشكل مستقل.
  • أكملت الأنظمة المهام الهندسية لكنها فشلت في إنتاج أوراق بحثية تستحق القبول في مؤتمر رائد للذكاء الاصطناعي.
  • حددت الدراسة خمسة أنماط فشل متكررة منعت الذكاء الاصطناعي من إنتاج أبحاث قابلة للنشر.

وجدت دراسة جديدة أن وكلاء الذكاء الاصطناعي الرواد اليوم يمكنهم إكمال العديد من المهام الهندسية المطلوبة لأبحاث الذكاء الاصطناعي، لكنهم فشلوا في إنتاج عمل أصيل يستحق القبول في مؤتمر رائد للتعلم الآلي.

في الدراسة التي نشرت يوم الأربعاء تحت عنوان "هل يمكن لوكلاء الذكاء الاصطناعي إجراء أبحاث ذكاء اصطناعي مفتوحة النهاية؟"، قام باحثون من جامعة برينستون، ومعهد أمن الذكاء الاصطناعي في المملكة المتحدة، وجامعة ستانفورد، وجامعة تورنتو، والعديد من المنظمات الأكاديمية والبحثية بتقييم ما إذا كان بإمكان وكلاء الذكاء الاصطناعي الرواد إجراء أبحاث ذكاء اصطناعي أصلية بشكل مستقل.

كتب الباحثون: "إن الإجابة على هذا السؤال بصرامة تتطلب أسئلة بحثية حقيقية وغير ملوثة لا يمكن للوكيل حفظها من بيانات تدريبه أو العثور عليها عبر الإنترنت". وأضافوا: "لتلبية هذه المتطلبات، اعتمدنا على أبحاث ذكاء اصطناعي عالية الجودة لم تكن علنية وقت إجراء التجارب."

زوّد الباحثون وكلاء الذكاء الاصطناعي بأسئلة البحث المحورية من ورقتين غير منشورتين من مؤتمر NeurIPS 2026، لمنع الأنظمة من استرداد الإجابات من بيانات التدريب أو الويب. حصل كل وكيل على ستة أيام، وآلاف الدولارات من أرصدة واجهة برمجة التطبيقات (API)، وموارد وحدات معالجة الرسوميات (GPU)، والوصول إلى الإنترنت، والوصول إلى جهاز افتراضي لإنتاج ورقة بحثية بجودة المؤتمر. ثم قام المؤلفون الأصليون للبحث غير المنشور بمراجعة الأوراق الناتجة. وقد تم رفض كليهما.

أكمل الوكلاء الكثير من الأعمال الهندسية المطلوبة للبحث، بما في ذلك إجراء مراجعات الأدبيات، وتصحيح الأخطاء البرمجية، وتشغيل التجارب، وإدارة موارد وحدات معالجة الرسوميات (GPU)، وإنتاج أوراق أكاديمية كاملة دون تدخل بشري. لكن المراجعين استنتجوا أن الأنظمة فشلت في توليد مساهمات علمية أصلية تستحق النشر في مؤتمر رائد للتعلم الآلي.

قال المؤلفون إن تقييمهم يقيس التفكير العلمي بشكل أفضل من المعايير السابقة لأنه يختبر مشاكل بحثية مفتوحة النهاية بدلاً من المهام المحددة مسبقًا.

حذر المؤلفون من أن الدراسة فحصت مشروعين بحثيين فقط واعترفوا بوجود قيود، بما في ذلك صغر حجم العينة وحقيقة أن الباحثين الأصليين قاموا بتقييم الأوراق البحثية التي أنتجها الذكاء الاصطناعي. وقالوا إن النتائج تشير إلى أن وكلاء الذكاء الاصطناعي الرواد الحاليين يمكنهم أتمتة العديد من المهام الهندسية المتضمنة في البحث لكنهم لا يزالون يواجهون صعوبة في توليد أعمال علمية أصلية.

تأتي هذه الدراسة في الوقت الذي يواصل فيه الباحثون الكشف عن سلوكيات مفاجئة وخطيرة أحيانًا لوكلاء الذكاء الاصطناعي الذين يزدادون استقلالية.

في مايو، وجد باحثون من جامعة كاليفورنيا ريفرسايد، ومايكروسوفت، وإنفيديا أن وكلاء الذكاء الاصطناعي قاموا بشكل متكرر بمهام خطيرة أو غير منطقية بينما ظلوا يركزون على إكمال أهدافهم. في وقت سابق من هذا الشهر، كشفت OpenAI أن أحد وكلاء الذكاء الاصطناعي الرواد لديها قد اخترق الحماية واخترق Hugging Face أثناء محاولته الغش في معيار للأمن السيبراني. هذا الأسبوع، كشفت الشركة أن الوكيل قد وصل أيضًا إلى أربع خدمات أخرى عبر الإنترنت.