جردت Anthropic 80% من تعليمات المطالبة النظامية الخاصة بها وأطلقت Opus 5، وهو نموذج Claude Code جديد يمكنه العمل بشكل مستقل لأيام أو أسابيع، وحقق درجة 30% في معيار Arc AGI. تتيح إعادة التصميم القائمة على "الضغط على زر الحذف"، والتي تسميها الشركة استراتيجية "إزالة القيود" (unhobbling)، ظهور القدرات الخام للذكاء الاصطناعي دون الأغلال البرمجية التي تبقي عادةً نماذج اللغة الكبيرة في وضع الدردشة فقط.

لماذا يهم هذا التغيير

كان مهندسو Anthropic يغمرون Claude بمجموعة كثيفة من حواجز الحماية (guardrails) — وهي مطالبات صريحة تخبر النموذج بما يجب قوله، وما لا يجب قوله، وكيفية البقاء في المهمة. تعمل هذه المطالبات مثل المقود، مما يمنع النموذج من الانحراف إلى سلوك غير مختبر ولكنه يحد أيضاً مما يمكنه إنجازه. عندما وصل Opus 5، قام الفريق بحذف مجموعة المطالبات بالكامل، ثم أعاد إضافة التعليمات واحدة تلو الأخرى، مع قياس تأثير كل منها. ولأن النموذج الجديد أكثر قدرة، فقد تخلوا عن معظم الصياغة الأصلية ومع ذلك حصلوا على نتائج موثوقة. أصبح النظام الآن يفهم هدفاً رفيع المستوى ويقوم بإنشاء ملفات وميزات كاملة.

العائد التقني

  • قفزة في المعايير المرجعية – حقق Opus 5 درجة 30% في معيار Arc AGI، وهو مقياس يقيس قدرة النموذج على حل المشكلات الجديدة. سجلت إصدارات Claude السابقة درجات أقل بكثير من هذا المستوى، مما يشير إلى قفزة كبيرة في قدرات الاستنتاج الخام.
  • استقلالية ممتدة – تتيح ميزة "Auto Mode" للنموذج العمل لفترات طويلة، مع الحفاظ على سياقه الخاص وإحراز تقدم دون الحاجة إلى توجيهات بشرية مستمرة. من الناحية العملية، يمكن للمطور تسليم المواصفات للنموذج وتركه يكرر العمل لأيام، مع التحقق فقط عند الوصول إلى مرحلة إنجاز معينة.
  • التحصين ضد حقن المطالبات (Prompt Injection) – تعمل تقنية حقن المطالبات على خداع النموذج لتجاهل قواعد السلامة الخاصة به عن طريق تضمين تعليمات خبيثة في مدخلات المستخدم. تقول Anthropic إن Opus 5 يقاوم هذا الهجوم بشكل أفضل من أسلافه، بفضل الأبحاث الداخلية والمصنفات المتخصصة التي تحدد الأنماط المشبوهة. كما يوصون بتحديد معايير الخروج وضوابط الحماية قبل الإطلاق.

الرهانات للمطورين والمؤسسات

بالنسبة للشركات الناشئة التي تبني أدوات مدعومة بالذكاء الاصطناعي، يوسع هذا التغيير "فجوة المنتج" (product overhang) — وهي الفجوة بين ما يمكن للنموذج فعله وما تسمح به البرمجيات المحيطة به. ومن خلال رفع تلك الفجوة، يمكن لـ Claude Code تحويل واجهة دردشة بسيطة إلى مساعد تطوير متكامل (full-stack) يكتب الكود ويختبره ويعيد هيكلته بشكل مستقل. أما المؤسسات التي تتبنى هذا النموذج، فيمكنها تقليل الوقت المستغرق في مهام البرمجة المتكررة، مما يفرغ المهندسين لأعمال التصميم رفيعة المستوى.

ماذا يعني مصطلح "unhobbling" حقاً

صاغ Cherny مصطلح "unhobbling" لوصف تحرير نموذج قادر من القيود الاصطناعية. في العديد من منتجات الذكاء الاصطناعي، يضع المطورون قيوداً متعمدة على ما يمكن للنموذج محاولته لأن واجهة المستخدم أو إطار السياسات ليس جاهزاً للنطاق الكامل للنموذج. والنتيجة هي "فجوة منتج" حيث يقبع الذكاء الاصطناعي على منصة من الإمكانات غير المستغلة. يأتي Claude Code بتلك الإمكانات إلى أرض الواقع، مما يسمح للنموذج بالعمل كمؤلف مشارك للبرمجيات بدلاً من مجرد بوت للإجابة على الأسئلة.

نصائح للمؤسسين والطلاب

  • حدد الفجوة – ابحث عن المهام التي تتعثر فيها أدوات الذكاء الاصطناعي الحالية بمجرد تجاوز حدودها الحالية. هذه هي "الفرص سهلة المنال" حيث يمكن لنهج "إزالة القيود" (unhobbling) أن يحقق عوائد كبيرة.
  • اختبر حدود النموذج – امنح الذكاء الاصطناعي مهاماً تبدو خارج قدراته المعلنة بقليل. قد يفاجئك الاستنتاج الداخلي للنموذج، خاصة عندما تقلل من الاحتكاك الناتج عن المطالبات.
  • حدد ضوابط حماية واضحة – قبل ترك النموذج يعمل دون إشراف، ضع شروط الخروج (مثل الحد الأقصى لوقت التشغيل، وسقوف الموارد) وفحوصات السلامة. يتيح ذلك للذكاء الاصطناعي الاستكشاف مع إبقاء المخاطر محدودة.

يجب على الطلاب المزج بين النظرية والتطبيق. إتقان الخوارزميات أمر قيم، ولكن الجمع بين تلك المعرفة والتفكير في المنتج والتجريب القائم على البيانات سيمكن الموجة القادمة من بناة الأنظمة القائمة على الذكاء الاصطناعي.

ما الذي يجب مراقبته لاحقاً

الخلاصة: من خلال حذف معظم مطالبات النظام الخاصة بها، سمحت Anthropic لنموذج أكثر ذكاءً بالعمل مع قدر أقل بكثير من التوجيه اليدوي، مما حول Claude Code إلى مبرمج مستقل يمكنه التعامل مع مشاريع تستمر لأسابيع.