الصفحة الرئيسةمركز أخبار LBank
كلود أوبوس 5 يتفوق على فيبل 5 في معظم المعايير — بنصف السعر
claude-opus-5-outscores-fable-5-most-benchmarks-half-price
كلود أوبوس 5 يتفوق على فيبل 5 في معظم المعايير — بنصف السعر
نموذج أنثروبيك اليومي الجديد يتفوق على منتجها الرائد في فعالية التكلفة ويتجاوزه في جميع الجوانب المهمة تقريباً.
2026-07-24 المصدر:decrypt.co

باختصار

  • يتكلف Claude Opus 5، الذي تم إصداره في 24 يوليو، 5 دولارات لكل مليون رمز إدخال — وهو نفس سعر سلفه Opus 4.8 ونصف سعر Fable 5 بالضبط — بينما يتفوق على Fable 5 في معظم المعايير الرئيسية.
  • سجل Opus 5 نسبة 43.3% في Frontier-Bench v0.1، وهو تقييم للترميز الآلي، مقابل 33.7% لـ Fable 5 و 34.4% لـ OpenAI's GPT-5.6 Sol؛ وعلى ARC-AGI-3، وهو معيار جديد لحل المشكلات، سجل 30.2% مقابل 7.8% لـ GPT-5.6 Sol — وهي فجوة ليست قريبة.
  • النموذج الجديد هو الافتراضي في Claude Max والأقوى في Claude Pro، ليحل محل Fable 5 بفعالية كخيار أساسي لمعظم المشتركين.

صدر Claude Opus 5 اليوم. إنه أرخص للشركات من نموذج Anthropic الرائد، Claude Fable 5، الذي وضعته الشركة كمنتج رائد يومي للمستخدمين المدفوعين. علاوة على ذلك، يتفوق Opus 5 عليه أيضًا في معايير مهمة.

لفهم مكانة Opus 5: تتكون تشكيلة Anthropic من أربع فئات. Haiku سريع ورخيص. Sonnet متوسط المدى. Opus هو الحصان العامل القوي. فوق ذلك تأتي فئة Mythos — وهي فئة قدمتها Anthropic هذا الربيع — والتي تشمل Claude Fable 5 للجمهور، و Claude Mythos 5، وهي نسخة ذات قيود أقل مخصصة من خلال Project Glasswing لباحثي الأمن السيبراني المعتمدين ومشغلي البنية التحتية الحيوية.

لقد مر Fable 5 بفترة صعبة كنموذج رائد للمشتركين. تم إطلاقه في 9 يونيو، وتم سحبه عالميًا بعد ثلاثة أيام بعد أن أصدرت الحكومة الأمريكية أمر تحكم في التصدير الطارئ مشيرة إلى ثغرة أمنية (jailbreak vulnerability)، وعاد في 30 يونيو — فقط ليتحول فورًا إلى نموذج يعتمد على الائتمانات فقط، ولم يعد مدرجًا في الخطط القياسية. يملأ Opus 5 الآن الفجوة التي لم يستطع Fable 5 الاحتفاظ بها.

قامت Lovable، وهي منصة للمطورين تضم ملايين المستخدمين، بتشغيل Opus 5 على تقييماتها الداخلية ولاحظت أن المكاسب تتجاوز النتائج الأولية: "إنه ليس أفضل فقط في مهام الترميز الآلي الأكثر صعوبة لدينا، بزيادة 22% عن Opus 4.7، بل إنه أكثر ثباتًا، مع تباين أقل بكثير بين عمليات التشغيل،" قال فابيان هيدين في بيان شاركته Anthropic.

المعايير

قد يبدو غريبًا، لكن Opus يتفوق على Fable في كل ما يهم المستخدم العادي تقريبًا، بينما لا يتم تصنيفه ضمن فئة Mythos مثل Fable.

في Frontier-Bench v0.1 — وهو معيار يختبر ما إذا كانت وكلاء البرمجة المدعمة بالذكاء الاصطناعي يمكنهم إكمال مهام هندسة البرمجيات الحقيقية من البداية إلى النهاية، ويتم تقييمه كنسبة مئوية من المهام التي تم اجتيازها — حقق Opus 5 نسبة 43.3%. بينما جاء Fable 5 بنسبة 33.7%. وسجل GPT-5.6 Sol من OpenAI، المنافس التجاري الرئيسي لـ Anthropic، نسبة 34.4%.

أوسع فارق يظهر في ARC-AGI-3، وهو اختبار لحل المشكلات الأصيل مبني على ألغاز جديدة لا يمكن للنموذج حفظها من بيانات التدريب، ويتم تقييمه كنسبة مئوية من الألغاز المحلولة. حقق Opus 5 نسبة 30.2%؛ بينما سجل GPT-5.6 Sol نسبة 7.8%؛ ولم يتم اختبار Fable 5 على الإطلاق. أما في GDPval-AA v2 — وهو معيار للعمل المعرفي يتم تقييمه من خلال تصنيفات إيلو (Elo ratings)، وهو نظام تصنيف على غرار الشطرنج يستخدم لقياس الأداء النسبي في المهام المهنية الحقيقية — وصل Opus 5 إلى 1,861 نقطة مقابل 1,747 نقطة لـ Fable 5 و 1,736 نقطة لـ GPT-5.6 Sol.

اختبرت Zapier نموذج Opus 5 على AutomationBench، وهو تقييم يقيس ما إذا كان النموذج يمكنه تنفيذ سير عمل تجاري كامل من البداية إلى النهاية دون مساعدة بشرية. حكمهم: أن النموذج "أخذ مصنفًا خامًا لحالة الحساب وقام بتشغيل تسلسل كامل لمنع التراجع من البداية إلى النهاية: تحديد الحسابات المعرضة للخطر، وتنبيه المالك الصحيح، وتلخيص عمليات الاحتفاظ. النماذج السابقة لم تنجح؛ بينما حقق Opus 5 نسبة 100%."

تروج Anthropic أيضًا لـ Opus 5 كترقية بحثية. صرحت Ultima Genomics، وهي شركة لتسلسل الحمض النووي، أن النموذج "يتصرف كعالم دقيق أكثر من أي نموذج قمنا بتشغيله. إنه يبحث عن الاختبارات الإحصائية الصحيحة لاستبعاد العوامل المربكة، ويتحقق من نتائجه الخاصة بطرق مستقلة، ويظل على المسار الصحيح خلال التحليلات متعددة الخطوات الطويلة."

ومع ذلك، فإن هذين المجالين — القانون والصحة — هما الوحيدان اللذان يتفوق فيهما Fable 5 بفارق ضئيل.

يأتي هذا الإصدار بعد أسبوع من كشف Moonshot AI، وهي شركة ناشئة مقرها بكين مدعومة من Alibaba، عن Kimi K3 — وهو نموذج مفتوح المصدر بـ 2.8 تريليون معلمة (مما يعني أن أي شخص يمكنه تنزيل الكود الأساسي لتشغيله بشكل مستقل) وتصفه Moonshot بأنه أكبر نظام ذكاء اصطناعي مفتوح في العالم. تضع المعايير المستقلة Kimi K3 باستمرار في المرتبة الثالثة بشكل عام، خلف Fable 5 و GPT-5.6 Sol، متفوقًا على هذين النموذجين في مجالات محددة.

يتوفر Opus 5 الآن عبر واجهة برمجة التطبيقات (API) بسعر 5 دولارات لكل مليون رمز إدخال و 25 دولارًا لكل مليون رمز إخراج. (الرموز هي الوحدة الأساسية للمعلومات التي يمكن لنموذج الذكاء الاصطناعي معالجتها في كل من الإدخال والإخراج). يتوفر أيضًا وضع سريع يعمل بسرعة تبلغ حوالي 2.5 ضعف السرعة الافتراضية، بضعف السعر الأساسي — 10 دولارات لكل مليون رمز إدخال و 50 دولارًا لكل مليون رمز إخراج.

قد ينهي هذا الإصدار القلق بشأن عدم توفر Fable 5 للجمهور. يتوفر Opus أيضًا عبر الاشتراك للجميع.