Claude Opus 5 من أنثروبيك: أداء يقارب Fable 5 بنصف السعر... والتسعير كما كان

الزبدة
- أنثروبيك تطلق Claude Opus 5 بأداء يقترب من نموذجها الأقوى Fable 5، لكن بنصف التكلفة تقريباً، مع إبقاء السعر ثابتاً عند 5 دولارات للإدخال و25 دولاراً للإخراج لكل مليون رمز، تماماً كما كان مع Opus 4.8
- النموذج الجديد يحقق طفرة حقيقية في اختبار الاستدلال الصعب ARC-AGI-3 بنسبة 30.16%، أي نحو 3 إلى 4 أضعاف أفضل نتيجة مسجلة سابقاً، إلى جانب 96% في اختبار SWE-bench Verified للبرمجة
- في مهام البرمجة الوكيلة طويلة المدى، تجاوز Opus 5 أداء إصداره السابق بأكثر من الضعف وتفوق على منافسين كبار مثل Fable 5 وGPT-5.6 Sol بتكلفة أقل، وهو الآن النموذج الافتراضي في Claude Max ومتاح عبر AWS
أطلقت أنثروبيك نموذجها الجديد Claude Opus 5 يوم الجمعة الموافق 24 يوليو 2026، ووضعته في مرتبة تقترب من قدرات نموذجها الرائد Fable 5، لكن بتكلفة تقارب نصف سعر الرموز (Tokens) لكل استخدام. الشركة تصف هذا الإصدار بأنه الأقوى في سلسلة Opus على الإطلاق، وهو يحل الآن محل Claude Opus 4.8 في جميع منتجاتها.
قصة التسعير: نفس السعر بقدرات أعلى
الملفت هنا أن Opus 5 لم يغيّر شيئاً في التسعير: 5 دولارات لكل مليون رمز إدخال (Input Tokens) و25 دولاراً لكل مليون رمز إخراج (Output Tokens)، وهي نفس الأرقام التي كانت معتمدة مع Opus 4.8. أنثروبيك تسوّق هذا على أنه "ذكاء يقترب من Fable 5 دون رفع أسعار فئة Opus"، لا خفضاً فعلياً في السعر، وهو فرق دقيق غابت عنه بعض التقارير الأولى التي اختزلت الأمر بعبارة "السعر لم يتغير" فحسب.
أرقام قياسية في الاختبارات
النتائج على اختبارات الأداء (Benchmarks) كانت لافتة. في اختبار SWE-bench Verified سجّل Opus 5 نسبة 96.0%، وفي النسخة الأصعب SWE-bench Pro حقق 79.2%. أما في SWE-bench Multimodal، فقد قفزت النتيجة من 38.4% التي حققها Opus 4.8 إلى 59.4%، وهي طفرة كبيرة بين جيلين من نموذج واحد.
في اختبار ARC-AGI-3، المصمم لقياس الاستدلال (Reasoning) على مشكلات جديدة غير محفوظة مسبقاً، سجّل Opus 5 نسبة 30.16% عند أعلى مستوى جهد. تصف أنثروبيك ومصادر مستقلة هذه النتيجة بأنها تتجاوز أفضل نتيجة سابقة بعدة أضعاف، مع اختلاف في تقدير الرقم الدقيق بين ثلاثة وأربعة أضعاف.
البرمجة الوكيلة (Agentic Coding) في الواجهة
صمّمت أنثروبيك Opus 5 خصيصاً للتفوق في البرمجة، والاستدلال المعرفي، ومهام الوكلاء الذاتيين طويلة المدى (Long-running Agents). في اختبار Frontier-Bench v0.1 الخاص بالبرمجة الوكيلة عبر الطرفية (Terminal Coding)، سجّل النموذج 43.3% عند أقصى جهد، متقدماً على Fable 5 (33.7%) وGPT-5.6 Sol (34.4%)، ومتجاوزاً أداء Opus 4.8 (21.1%) بأكثر من الضعف، وكل ذلك بتكلفة أقل لكل مهمة.
في تقييم GDPval-AA v2 التابع لمنصة Artificial Analysis، حصل Opus 5 على تقييم إيلو (Elo) بلغ 1,861، متقدماً بوضوح على Fable 5 (1,747) وGPT-5.6 Sol (1,736). أما في اختبار AutomationBench الخاص بشركة Zapier، فتقول أنثروبيك إن معدل نجاح Opus 5 يبلغ نحو 1.5 مرة أفضل من أقرب منافس له بنفس التكلفة لكل مهمة.
قفزات في العلوم والاستدلال المتخصص
حقق النموذج أيضاً تقدماً في مهام الاستدلال المتخصص. تفيد أنثروبيك بتحسن نسبته 10.2 نقطة مئوية مقارنة بـ Opus 4.8 في مهام الكيمياء العضوية التي تتطلب استنتاج التراكيب الجزيئية من بيانات التحليل الطيفي (Spectroscopy)، وتحسن بنسبة 7.7 نقطة في التنبؤ بوظيفة البروتين بناءً على تغيّرات تسلسله الجيني.
اختبار غير مألوف: طرحت أنثروبيك جميع مسائل أولمبياد الرياضيات الدولي (IMO) لعام 2026 الست على Opus 5 دون أي أدوات مساعدة، وأشرفت لجنة تحكيم من ثلاثة نماذج قيّمت الحلول الأربعة والعشرين المولّدة جميعها كصحيحة.
يحتفظ Claude Opus 5 بنافذة سياق (Context Window) تبلغ مليون رمز، كما كانت في إصدارات Opus السابقة، وأصبح الآن النموذج الافتراضي في خدمة Claude Max والخيار الأعلى في Claude Pro. النموذج متاح أيضاً عبر منصة AWS من خلال Claude Platform، ما يفتح مساراً مباشراً لعملاء المؤسسات إلى جانب قنوات الوصول الاستهلاكية وواجهة برمجة التطبيقات (API) الخاصة بأنثروبيك.
التغطيات والأبحاث الأصلية التي استند إليها هذا المقال.
- 1Introducing Claude Opus 5 on AWS: Anthropic’s most capable Opus modelaws.amazon.com
- 2Anthropic claims its new Claude Opus 5 delivers near-Fable 5 performance at half the token pricethe-decoder.com
- 3Meet the New Claude Opus 5: Frontier-Class Agentic Coding and Computer Use at Unchanged Opus Pricingmarktechpost.com
- 4Introducing Claude Opus 5anthropic.com
- 5Anthropic launches Opus 5techcrunch.com
- 6Anthropic releases Opus 5 with ‘close’ to Fable 5’s capabilitiestheverge.com
- 7Claude Opus 5aixploria.com
فريق تحرير واكب
تم إعداد هذه المراجعة وتلخيصها بواسطة محرك الذكاء الاصطناعي الخاص بواكب ومراجعتها وتدقيقها من قبل فريقنا التحريري لضمان الدقة والموثوقية.
اشترك في النشرة البريدية
احصل على ملخص أسبوعي لأبرز أبحاث وأدوات الذكاء الاصطناعي مباشرة في بريدك.
قناة التليجرام
تابع تغطيتنا اللحظية ونقاشاتنا حول آخر مستجدات وأنظمة الذكاء الاصطناعي.
