Anthropic تكشف عن Claude Opus 5: أداء متميز بنصف التكلفة
أطلقت Anthropic رسميًا Claude Opus 5، وهو نموذج رائد جديد صُمم لإحداث تغيير جذري في سوق النماذج اللغوية الكبيرة (LLM) عالية المستوى، من خلال تقديم أداء يقارب أداء نموذج Claude Fable 5 المتميز ولكن بسعر أقل بكثير. تهدف هذه الخطوة الاستراتيجية إلى تحييد ضغوط الأسعار من المنافسين مثل GPT-5.6 Sol، مع تزويد المطورين بأداة أكثر كفاءة للبرمجة وأعمال المعرفة المعقدة.
إحداث تغيير في حدود السعر مقابل الأداء
الميزة الأكثر لفتاً للانتباه في Claude Opus 5 هي هيكل تسعيره الهجومي. فبينما تبلغ تكلفة نموذج Claude Fable 5 من الفئة العليا 10 دولارات لكل مليون رمز إدخال (input tokens) و50 دولاراً لكل مليون رمز إخراج (output tokens)، يقوم Opus 5 بخفض هذه المعدلات إلى النصف، حيث يبلغ سعره 5 دولارات لكل مليون رمز إدخال و25 دولاراً لكل مليون رمز إخراج.
ولمعالجة متطلبات زمن الاستجابة (latency)، قدمت Anthropic أيضاً "الوضع السريع" (Fast Mode)، الذي يزيد سرعة المعالجة بمقدار 2.5 ضعفاً، وإن كان ذلك على حساب مضاعفة سعر الرمز. هذا التسعير المتدرج، إلى جانب نافذة سياق ضخمة تبلغ مليون رمز، يضع Opus 5 كنموذج افتراضي جديد لـ Claude Max والخيار الأكثر قدرة لمستخدمي Claude Pro.
التفوق في الاختبارات المعيارية في البرمجة والاستنتاج
لا يعد Opus 5 مجرد بديل اقتصادي؛ بل هو قوة أداء هائلة في مجالات محددة. ففي البرمجة عبر الطرفية الوكيلية (agentic terminal coding) من خلال اختبار Frontier-Bench v0.1، حقق Opus 5 درجة 43.3%، متفوقاً بشكل ملحوظ على كل من Fable 5 (33.7%) وGPT-5.6 Sol (34.4%). كما أظهر هيمنة في أعمال المعرفة، متصدراً اختبار GDPval-AA v2 بدرجة Elo بلغت 1,861.
ولعل الإحصائية الأكثر إذهالاً تأتي من اختبار ARC-AGI-3، الذي يقيس القدرة على حل المشكلات الجديدة. حيث سجل Opus 5 نسبة 30.2%، وهو ما يعادل تقريباً أربعة أضعاف نسبة 7.8% التي حققها GPT-5.6 Sol. يشير هذا إلى قفزة هائلة في قدرة النموذج على التعامل مع المهام التي تقع خارج أنماط بيانات التدريب الخاصة به.
التوسع الذكي للجهد والكفاءة
قدمت Anthropic نظام "جهد" (effort) متطوراً، يتيح للمستخدمين التبديل بين خمسة إعدادات: منخفض (low)، ومتوسط (medium)، وعالٍ (high)، وعالٍ جداً (xhigh)، وأقصى (max). يتيح ذلك موازنة دقيقة بين استهلاك الرموز وعمق الاستنتاج.
وبينما توصي Anthropic بإعدادات "low" و"medium" للمهام العامة لتحسين التكاليف، فإنها تنصح باستخدام "xhigh" للبرمجة الوكيلية المعقدة. ومن المثير للاهتمام أن الشركة لاحظت تراجعاً في العائد عند إعداد "max"؛ ففي كل من Frontier-Bench v0.1 ومؤشر Artificial Analysis Coding Agent، شهد Opus 5 في الواقع انخفاضاً طفيفاً في الأداء عند بذل أقصى جهد رغم التكلفة الأعلى، مما يشير إلى أن إعداد "xhigh" قد يكون النقطة المثالية الحالية للكفاءة.
تحسين السلامة والاستقلالية
واستجابةً مباشرة لآراء المستخدمين، قامت Anthropic بضبط مصنفات السلامة لنموذج Opus 5. حيث تعمل الفلاتر السيبرانية للنموذج بمعدل أقل بنسبة 85% تقريبًا مقارنة بـ Fable 5، مما يعالج الانتقادات السابقة المتعلقة بالحظر المفرط للأبحاث المشروعة. وبينما لا يزال النموذج يمنع إنشاء الثغرات (exploit generation) والمسح القائم على الملفات الثنائية (binary-based scanning)، إلا أنه أكثر تسامحاً بكثير فيما يتعلق بأبحاث ثغرات الكود المصدري.
علاوة على ذلك، يظهر Opus 5 قدرات محسنة على التصحيح الذاتي. ففي اختبارات العالم الحقيقي، نجح النموذج في بناء نموذج ثلاثي الأبعاد في FreeCAD عن طريق كتابة مسار رؤية حاسوبية (computer vision pipeline) خاص به لتفسير الهندسة—وهي مهمة عجزت عنها جميع النماذج المنافسة الأخرى.
النقاط الرئيسية
- خفض هائل في التكاليف: يوفر Opus 5 أداءً بمستوى النماذج الرائدة بنسبة 50% فقط من تكلفة الرموز لنموذج Claude Fable 5.
- طفرة في الاستنتاج: أظهر النموذج تفوقاً هائلاً بمقدار 4 أضعاف على المنافسين في اختبار ARC-AGI-3 لحل المشكلات الجديدة.
- سير عمل محسن للمطورين: مع مصنفات سلامة محسنة وإعدادات "جهد" متخصصة، يوفر Opus 5 تجربة أكثر سلاسة للبرمجة الوكيلية والأبحاث.
