أطلقت شركة Anthropic Claude Opus 5 في 24 يوليو، بسعر 5 دولارات لكل مليون من رموز الإدخال—أي نصف تكلفة نموذجها السابق Claude Fable 5—فيما حقق تفوقاً على Fable 5 في معظم الاختبارات الرئيسية. سجّل Opus 5 43.3% على Frontier-Bench v0.1، وهو تقييم برمجة وكيلية، مقابل 33.7% لـ Fable 5 و34.4% لـ GPT-5.6 Sol الخاص بـ OpenAI. وعلى ARC-AGI-3، وهو مقياس جديد لحل المشكلات، سجل 30.2% مقابل 7.8% لـ GPT-5.6 Sol. أصبح النموذج الجديد افتراضياً على Claude Max وخياراً أقوى على Claude Pro، ليحل عملياً محل Fable 5 كخيار مفضل لمعظم المشتركين بعد الاضطرابات التشغيلية التي شهدتها Fable 5 في وقت سابق من هذا الصيف.
تضم مجموعة Anthropic أربع فئات: Haiku سريع ورخيص، Sonnet في النطاق المتوسط، Opus هو محرك العمل الثقيل، وفئة Mythos—التي تم تقديمها هذا الربيع—تتضمن Claude Fable 5 للجمهور وClaude Mythos 5 للباحثين المتحققين في الأمن السيبراني ومشغلي البنية التحتية الحرجة عبر Project Glasswing.
Claude Opus 5 يتفوق على Fable 5 عبر أبرز الاختبارات
على Frontier-Bench v0.1، الذي يختبر ما إذا كانت وكلاء برمجة الذكاء الاصطناعي قادرين على إنجاز مهام هندسة برمجيات حقيقية من البداية إلى النهاية، حقق Opus 5 نسبة 43.3%. جاءت Fable 5 عند 33.7%، وسجل GPT-5.6 Sol من OpenAI 34.4%.
ظهر أوسع هامش على ARC-AGI-3، وهو اختبار لحل المشكلات مبني على ألغاز جديدة لا يمكن للنموذج أن يكون قد حفظها من بيانات التدريب. سجل Opus 5 30.2%؛ وسجل GPT-5.6 Sol 7.8%؛ ولم يتم اختبار Fable 5.
على GDPval-AA v2، وهو معيار لأعمال المعرفة تُسجّل نتيجته عبر تقييمات Elo لقياس الأداء النسبي في مهام مهنية واقعية، وصل Opus 5 إلى 1,861 مقابل 1,747 لـ Fable 5 و1,736 لـ GPT-5.6 Sol.
تفوقت Fable 5 على Opus 5 بهامش صغير فقط في التقييمات المتعلقة بالقانون والصحة، وفقاً للمعايير المنشورة من Anthropic.
تسعير Anthropic لـ Opus 5 بسعر 5 دولارات لكل مليون من رموز الإدخال
يتاح Opus 5 عبر API بسعر 5 دولارات لكل مليون من رموز الإدخال و25 دولاراً لكل مليون من رموز الإخراج. ويتوفر وضع Fast يعمل بسرعة تبلغ تقريباً 2.5 ضعف السرعة الافتراضية بسعر يساوي ضعفي السعر الأساسي—10 دولارات لكل مليون رموز إدخال و50 دولاراً لكل مليون رموز إخراج.
يأتي التسعير مطابقاً لـ Opus 4.8، وهو أيضاً أقل بما يعادل نصف تكلفة Fable 5 تماماً، التي كانت Anthropic قد وضعتها كمنتج يومي على مستوى الجبهة للمستخدمين الدافعين.
سحب Fable 5 عالمياً بعد أمر تقييد التصدير
أُطلق Fable 5 في 9 يونيو، ثم تم سحبه عالمياً بعد ثلاثة أيام إثر إصدار حكومة الولايات المتحدة أمراً طارئاً بتقييد الصادرات، مستشهدةً بوجود ثغرة في اختراق الحماية (jailbreak)، وعاد في 30 يونيو. عند عودته، انتقل فوراً إلى نموذج يعتمد على الاعتمادات فقط، ولم يعد مشمولاً ضمن الخطط القياسية.
يملأ Opus 5 الآن المنصب الذي لم تستطع Fable 5 الاحتفاظ به كواجهة رائدة للمشتركين.
منصات طرف ثالث تتحقق من مكاسب أداء Opus 5
Lovable، منصة للمطورين تضم ملايين المستخدمين، شغّلت Opus 5 ضمن تقييماتها الداخلية. وقال Fabian Hedin في بيان شاركته Anthropic: "ليس فقط إنه الأفضل في أصعب مهام البرمجة الوكيلية لدينا، إذ يتحسن بنسبة 22% على Opus 4.7، بل إنه أكثر ثباتاً، مع تباين أقل بكثير عند التشغيل من مرة إلى أخرى".
اختبرت Zapier Opus 5 على AutomationBench، وهو تقييم يُسجّل ما إذا كان النموذج قادراً على تنفيذ سير عمل تجاري كامل من البداية إلى النهاية دون مساعدة بشرية. و"قام النموذج بأخذ ملف عمل خام عن صحة الحساب وتنفيذ تسلسل كامل لمنع الإبطاء (churn) من البداية إلى النهاية: تحديد الحسابات المعرضة للمخاطر، وإشعار المسؤول المناسب، وتلخيص النتائج لعمليات الاحتفاظ (retention ops). لم تنجح النماذج السابقة؛ حقق Opus 5 نسبة 100%".
قالت Ultima Genomics، وهي شركة لتسلسل الحمض النووي (DNA)، إن النموذج "يتصرف أكثر مثل عالم حذر من أي نموذج قمنا بتشغيله. فهو يلجأ إلى الاختبارات الإحصائية الصحيحة لاستبعاد العوامل المربكة، ويُجري تحققاً من نتائجه بطرق مستقلة، ويبقى ضمن المسار خلال تحليلات طويلة ومتعددة الخطوات".
وصل هذا الإصدار بعد أسبوع من قيام Moonshot AI، وهي شركة ناشئة مقرها بكين ومدعومة من Alibaba، بالكشف عن Kimi K3—وهو نموذج مفتوح الوزن يضم 2.8 تريليون معلمة—وصفته Moonshot بأنه أكبر نظام ذكاء اصطناعي مفتوح في العالم. وتضع الاختبارات المعيارية المستقلة لـ Kimi K3 باستمرار في المرتبة الثالثة إجمالاً، خلف كل من Fable 5 وGPT-5.6 Sol، متفوقاً على هذين في مجالات محددة.
الأسئلة الشائعة
ما الاختبارات التي تفوق فيها Claude Opus 5 على Fable 5؟
سجّل Claude Opus 5 43.3% على Frontier-Bench v0.1 مقابل 33.7% لـ Fable 5، و30.2% على ARC-AGI-3 (لم يتم اختبار Fable 5)، و1,861 على GDPval-AA v2 مقابل 1,747 لـ Fable 5. تفوقت Fable 5 على Opus 5 بهامش صغير فقط في التقييمات المتعلقة بالقانون والصحة.
كم تبلغ تكلفة Claude Opus 5 مقارنة بـ Fable 5؟
تبلغ تكلفة Claude Opus 5 5 دولارات لكل مليون من رموز الإدخال و25 دولاراً لكل مليون من رموز الإخراج عبر API—وهي نصف التكلفة الضمنية لـ Fable 5 بالضبط. ويتوفر وضع Fast بسعر 10 دولارات لكل مليون من رموز الإدخال و50 دولاراً لكل مليون من رموز الإخراج.
لماذا تم سحب Claude Fable 5 من الإتاحة العالمية؟
أُطلق Fable 5 في 9 يونيو وتم سحبه عالمياً بعد ثلاثة أيام بعد إصدار حكومة الولايات المتحدة أمراً طارئاً بتقييد الصادرات، مستشهدةً بوجود ثغرة في اختراق الحماية (jailbreak). وعاد في 30 يونيو كنموذج يعتمد على الاعتمادات فقط، ولم يعد مشمولاً ضمن الخطط القياسية.