رفعت وكلاء Claude AI النسبة المتحقق منها لأصفار ريمان زيتا التي تقع على الخط الحرج من 41.6% إلى 67.2%. هذه القفزة لا تثبت فرضية ريمان، ولكنها تظهر أن سير العمل المدفوع بالذكاء الاصطناعي واسع النطاق يمكن أن ينتج نتيجة قابلة للتحقق رياضياً.

لماذا تهم فرضية ريمان

تؤكد الفرضية أن كل صفر غير بديهي لدالة ريمان زيتا له جزء حقيقي يساوي ½ تماماً. تتحكم هذه الأصفار في توزيع الأعداد الأولية، لذا فإن تأكيد هذا التخمين من شأنه أن يعزز الارتباط بين أنماط الأعداد الأولية والتحليل المركب. وحتى الآن، ثبت وقوع جزء فقط من الأصفار على "الخط الحرج". ويعد رفع هذه النسبة معياراً قياسياً للتقدم.

كيف وصلت Anthropic إلى 67.2%

قامت Anthropic بتشغيل Claude Code، وهو نموذجها المخصص للبرمجة، عبر جلستين بحثيتين مكثفتين. وظفت الجلسة الثانية 60 وكيلاً فرعياً نسقوا فيما بينهم عبر أكثر من 2,400 أمر shell وأنتجوا مئات من سكربتات Python. في المجمل، أنتجت العملية ما يقرب من 31 مليون توكن مخرجات—وهو ما يعادل حجم رواية قصيرة تقريباً.

قام علماء الرياضيات في الفريق بمراجعة الورقة الناتجة وأصدروا صياغة رسمية باستخدام Lean 4، وهي لغة إثبات يتم التحقق منها آلياً، لتمكين الآخرين من التحقق من كل خطوة. استخدم العمل نسخة بحثية داخلية غير منشورة من Claude، واعتمد التحقق على فحوصات داخلية ومراجعات خبراء موجزة بدلاً من مراجعة الأقران الرسمية.

ما تقوله النتيجة فعلياً

ترفع الورقة الجديدة الحد الأدنى المثبت للأصفار على الخط الحرج من 41.6% إلى 67.2%. هذا الرقم هو حد أدنى: فقد تقع أصفار أكثر بكثير على الخط، لكن التحليل لم يشملها.

والأهم من ذلك، أن النتيجة لا تقرب الفرضية نفسها من إثبات كامل. تتطلب الفرضية أن تكون جميع الأصفار غير البديهية على الخط؛ والحد الأدنى البالغ 67.2% يترك أكثر من ثلث الأصفار دون تفسير.

حدود نهج الذكاء الاصطناعي

توضح تصريحات Anthropic نفسها أنها لا تتوقع أن يحسم سير العمل الحالي الفرضية قريباً. فلا يزال يتعين على البشر مراجعة مخرجات النموذج بحثاً عن فجوات منطقية، كما تفتقر عملية التحقق الداخلية إلى صرامة مراجعة الأقران المجتمعية. وبما أن النسخة البحثية من Claude غير متاحة للجمهور، فإن إمكانية إعادة إنتاج النتائج بشكل مستقل تظل محدودة.

ما الخطوة التالية

إن إصدار الصياغة الرسمية باستخدام Lean 4 يدعو المجتمع الرياضي الأوسع لمراجعة الإثبات.

الخلاصة

أثبت وكلاء Claude من Anthropic أن الذكاء الاصطناعي يمكنه تسريع عملية التحقق من العبارات الرياضية المعقدة، مما حقق تحسناً ملحوظاً في الحد الأدنى المعروف لأصفار ريمان زيتا. ويعد هذا الاختراق بمثابة إثبات لمفهوم سير عمل الوكلاء البحثيين واسع النطاق، وليس حلاً لمسألة جائزة الألفية نفسها.