Mistral تطلق Leanstral 1.5: طفرة في الرياضيات الرسمية والتحقق من الكود
أطلقت Mistral AI رسميًا Leanstral 1.5، وهو نموذج قوي مفتوح المصدر تم تصميمه خصيصًا للتحقق الرسمي (formal verification) باستخدام لغة البرمجة Lean 4. ومن خلال إتقان صرامة البراهين الرياضية وصحة البرمجيات، يمثل هذا النموذج قفزة نوعية كبيرة في فائدة الذكاء الاصطناعي مفتوح المصدر في البيئات التقنية عالية المخاطر.
الهيمنة على معايير الرياضيات الرسمية
تم تصميم Leanstral 1.5 للتعامل مع المنطق المعقد الذي تتطلبه لغة Lean 4، وهي لغة صُممت للتحقق من البراهين الرياضية وموثوقية البرمجيات. ولا يمكن وصف أداء النموذج في المعايير المتخصصة إلا بأنه استثنائي؛ فقد حقق درجة كاملة بنسبة 100% في miniF2F، وهو معيار يتراوح من رياضيات المستوى الثانوي إلى الصعوبة البالغة لأولمبياد الرياضيات.
وعند اختباره مقابل PutnamBench — وهو مجموعة تضم 672 مسألة من مسابقة Putnam الرياضية المرموقة — نجح Leanstral 1.5 في حل 587 مسألة. ويضع هذا الأداء النموذج في صدارة المجال مفتوح المصدر، حيث لا يتفوق عليه سوى Aleph Prover مغلق المصدر. علاوة على ذلك، أظهر النموذج إتقانًا للرياضيات بمستوى الدراسات العليا في الجبر، حيث سجل 87% في معيار FATE-H و34% في FATE-X، واللذين يغطيان مواضيع متقدمة مثل نظرية الزمر والحلقات (group and ring theory).
ما وراء الرياضيات: اكتشاف أخطاء الكود في العالم الحقيقي
بينما تتصدر براعته الرياضية العناوين، يثبت Leanstral 1.5 أنه أداة هائلة لمهندسي البرمجيات من خلال قدراته على التحقق من الكود. وقد أثبتت Mistral الفائدة العملية للنموذج من خلال نشره لفحص 57 مستودعًا (repository) مختلفًا مفتوح المصدر.
وفي هذا التطبيق الواقعي، نجح النموذج في تحديد خمسة أخطاء (bugs) لم تكن معروفة من قبل. وكان أحد الاكتشافات البارزة هو خطأ تجاوز السعة (overflow bug) الموجود داخل مكتبة varinteger بلغة Rust. وتشير هذه القدرة على رصد الأخطاء الدقيقة ذات العواقب الوخيمة في الكود البرمجي المخصص للإنتاج إلى أن Leanstral 1.5 يمكن أن يعمل كـ "اختبار سلامة" (sanity check) مؤتمت للمطورين الذين يعملون بلغات آمنة للذاكرة أو لغات المهام الحرجة.
الصرامة التقنية وسهولة الوصول
تضمن تطوير Leanstral 1.5 مسار تدريب متطورًا يتكون من التدريب المتوسط (mid-training)، والضبط الدقيق الخاضع للإشراف (SFT)، والتعلم التعزيزي (RL). ويضمن هذا النهج متعدد المراحل أن النموذج لا يتنبأ بالرمز (token) التالي فحسب، بل يفهم الهياكل المنطقية الأساسية المطلوبة للاستدلال الرسمي.
وفي خطوة تعزز النظام البيئي مفتوح المصدر، أصدرت Mistral النموذج بموجب ترخيص Apache 2.0. وهذا يسمح للمطورين والباحثين بدمج النموذج وتعديله ونشره بأقل قدر من القيود. يتوفر Leanstral 1.5 حاليًا عبر Hugging Face ومن خلال API مجاني، مما يقلل من حواجز الدخول للفرق التي تتطلع إلى تنفيذ التحقق الرسمي في سير عملها.
النقاط الرئيسية
- التميز في المعايير: حقق Leanstral 1.5 درجة 100% في miniF2F ويتفوق على جميع المنافسين مفتوحي المصدر تقريبًا في PutnamBench واختبارات الجبر بمستوى الدراسات العليا.
- تصحيح الأخطاء العملي: أثبت النموذج قدرته على العثور على ثغرات في العالم الحقيقي، مثل خطأ تجاوز السعة في مكتبة Rust، أثناء عمليات فحص المستودعات.
- تمكين المصدر المفتوح: تم إصدار النموذج بموجب ترخيص Apache 2.0، وهو متاح بسهولة عبر Hugging Face وAPI مجاني لمجتمع المطورين العالمي.
