OpenAI کے اندرونی Astra سسٹم نے اعلان کیا ہے کہ اس نے ریاضی کے دس دیرینہ مسائل کے لیے رسمی ثبوت (formal proofs) تیار کیے ہیں، اور ہر دعوے کی تصدیق Lean 4 میں مشین کے ذریعے چیک شدہ تصدیق کے ساتھ کی ہے۔ ٹیم نے ایک تکنیکی مقالہ اور ایک اوپن سورس ریپوزٹری جاری کی ہے، جس سے کوئی بھی اس کوڈ کو دیکھ سکتا ہے جس نے خام سوچ (raw reasoning) کو ایک ایسے ثبوت میں بدل دیا جسے کمپائلر یا تو قبول کر سکتا ہے یا مسترد۔ ان ڈویلپرز کے لیے جو چاہتے ہیں کہ AI اعلیٰ درجے کے حساس شعبوں میں مدد کرے، یہ نتیجہ ایسے ورک فلو بنانے کے لیے ایک ٹھوس ٹیمپلیٹ ہے جہاں ماڈل آئیڈیاز تو پیدا کرتا ہے لیکن کبھی یہ فیصلہ نہیں کرتا کہ کیا سچ ہے۔

Astra کی یہ پیش رفت کیوں اہم ہے

لارج لینگویج ماڈلز (LLMs) ایسا متن تیار کرتے ہیں جو دیکھنے میں معقول لگتا ہے، لیکن وہ اکثر حقائق کے بارے میں غلط بیانی (hallucinate) کرتے ہیں یا منطقی مراحل کو اس طرح جوڑتے ہیں جو حقیقت میں ایک دوسرے کے تسلسل میں نہیں ہوتے۔ کم خطرے والے حالات میں ایک انسانی جائزہ لینے والا زیادہ تر غلطیوں کو پکڑ سکتا ہے، لیکن فنانس، میڈیسن، یا سائنسی تحقیق میں، ایک غیر دریافت شدہ غلطی کی قیمت تباہ کن ہو سکتی ہے۔ Astra ایک ایسا طریقہ دکھاتا ہے جس سے LLM کی تخلیقی طاقت کو برقرار رکھتے ہوئے اس کے نتائج پر اندھا دھند بھروسہ کرنے کی ضرورت کو ختم کیا جا سکتا ہے۔

وہ راستہ جو تصدیق شدہ نتیجے تک لے گیا

OpenAI کے انجینئرز نے Astra کو تین مراحل پر مشتمل ایک پائپ لائن کے گرد بنایا ہے:

  1. Generation – ماڈل تکراری منطقی چکر (iterative reasoning loops) چلاتا ہے، اور ثبوت کے ممکنہ مراحل تجویز کرتا ہے۔
  2. Exposition – انسان اور ماڈل ان مراحل کو ایک قابلِ فہم بیانیے کی شکل دینے کے لیے مل کر کام کرتے ہیں۔
  3. Formalization – اس بیانیے کو Lean 4 کوڈ میں منتقل کیا جاتا ہے، جسے ایک کمپائل器 لائن بہ لائن چیک کرتا ہے۔

اہم قدم Lean 4 کو کام سونپنا ہے۔ عام ٹیکسٹ کی وضاحت کے برعکس، Lean 4 ہر استدلال (inference) کو ایک سخت منطقی کرنل کے مطابق ثابت کرنے پر مجبور کرتا ہے۔ اگر کمپائلر کسی غلطی کی نشاندہی کرتا ہے، تو پائپ لائن اس غلطی کو اصلاح کے لیے دوبارہ ماڈل کو بھیج دیتی ہے۔ حتمی فیصلہ LLM نہیں بلکہ تصدیق کنندہ (verifier) دیتا ہے۔

ڈویلپرز اور تنظیموں کے لیے اہمیت

  • Reliability – جب AI کے ذریعے تیار کردہ کوئی آرٹفیکٹ ریگولیٹری یا حفاظتی معیار پر پورا اترنی ہو، تو ایک رسمی تصدیق کنندہ (formal verifier) ایک آڈٹ ٹریل فراہم کرتا ہے جسے صرف اصل ڈویلپر ہی نہیں بلکہ آڈیٹرز بھی معائنہ کر سکتے ہیں۔

یہ طریقہ کار اضافی کام (overhead) کا باعث بنتا ہے۔ ایسی وضاحتیں (specifications) لکھنا جنہیں تصدیق کنندہ سمجھ سکے، ایک رسمی ثبوت کے ماحول کو برقرار رکھنا، اور انجینئرز کو تصدیق کی ناکامیوں کی تشریح کرنے کے لیے تربیت دینا، یہ سب سرمایہ کاری کا تقاضا کرتے ہیں۔ ہر شعبے میں حتمی فیصلہ کرنے کے لیے کوئی بالغ تھیورم پروور (theorem prover) یا ٹائپ سسٹم موجود نہیں ہوتا۔

وہ تفصیلات جنہیں زیادہ تر مضامین نظر انداز کر دیتے ہیں

  • مشین کے قابلِ فہم آؤٹ پٹ ضروری ہے۔ Astra نے ماڈل سے کبھی بھی آزادانہ نثر (free-form prose) نہیں مانگی؛ اس نے واضح طور پر کوڈ کے ٹکڑے (code snippets) اور اسکیما کی تعریفیں مانگیں جنہیں Lean 4 کمپائلر استعمال کر سکے۔
  • فیڈ بیک لوپس فرق کو ختم کرتے ہیں۔ جب کمپائلر کسی ٹائپ ایرر یا غیر ثابت شدہ لیمہ (unproven lemma) کی اطلاع دیتا ہے، تو اس تشخیص کو دوبارہ جنریشن لوپ میں بھیج دیا جاتا ہے، جس سے ماڈل خود بخود اپنے مفروضے پر نظر ثانی کر سکتا ہے۔
  • انسان کا عمل میں شامل ہونا (Human-in-the-loop) تزویراتی رہتا ہے۔

اپنا قابلِ تصدیق AI ورک فلو بنانا

  • جنریشن کو ویلیڈیشن سے الگ کریں۔ LLM کو ایک یقینی (deterministic) ٹول کے ساتھ جوڑیں—جیسے کہ ایک کمپائلر، اسٹیٹک اینالائزر، یا یونٹ ٹیسٹ ہارنس—جو آزادانہ طور پر ہر دعوے کی تصدیق کر سکے۔
  • ساختیاتی اشیاء (structured artifacts) کا مطالبہ کریں۔ "الگورتھم کی وضاحت کریں" کہنے کے بجائے، ایک کوڈ فائل، JSON اسکیما، یا ثبوت کا اسکرپٹ مانگیں جسے مشین پڑھ سکے۔
  • غلطی کا فیڈ بیک ماڈل میں شامل کریں۔ تصدیق کنندہ کے ایرر میسجز کو حاصل کریں اور انہیں پرامپٹس کے طور پر دوبارہ بھیجیں، تاکہ ماڈل انسانی مداخلت کے بغیر اصلاح کی کوشش کر سکے۔
  • پہلے سے درست وضاحتیں (specifications) طے کریں۔ تصدیق کنندہ صرف ان اصولوں کے مطابق چیک کر سکتا ہے جو آپ اسے دیتے ہیں؛ اگر وضاحت مبہم یا غلط ہے، تو ثبوت بے معنی ہوگا۔

جوابی نکات اور حدود

آگے کیا دیکھنا ہے

خلاصہ

LLM کو ایک آئیڈیاز دینے والے ساتھی (brainstorming partner) کے طور پر لیں، نہ کہ ایک جج کے طور پر۔ ایک یقینی تصدیق کنندہ کو—خواہ وہ کمپائلر ہو، لینٹر (linter) ہو، یا رسمی ثبوت کا انجن—حتمی فیصلہ کرنے دیں۔ جب ان دونوں کو صفائی سے جوڑا جاتا ہے، تو آپ کو بغیر کسی چھپے ہوئے خطرے (غیر چیک شدہ ہیلو سینیشنز) کے جنریٹو AI کی رفتار حاصل ہوتی ہے۔