Anthropic نے یکم ستمبر کو Claude Fable 5.1 اور Claude Mythos 5.1 متعارف کرائے۔ دونوں ماڈلز اب 1 ملین ٹوکنز کا سیاق و سباق (context) قبول کر سکتے ہیں، 128k ٹوکنز تک آؤٹ پٹ دے سکتے ہیں، اور فی الحال ہی اپنی استدلال کی گہرائی (reasoning depth) کو ایڈجسٹ کر سکتے ہیں—اور یہ سب فی کال لاگت کو کم کرتے ہوئے کیا جا رہا ہے۔ یہ اپ گریڈز صرف تیز رفتار بینچ مارک اسکورز کے لیے نہیں بلکہ سستی اور زیادہ قابل اعتماد AI سے مدد یافتہ کوڈنگ اور حساس تحقیق کے لیے ہیں۔
نئی ورژن کیوں اہم ہیں
Claude کی پچھلی نسل میں سیاق و سباق کی حد (context window) چند ہزار ٹوکنز تک محدود تھی، جس کی وجہ سے ڈویلپرز کو کوڈ یا ڈیٹا کو دستی طور پر تقسیم کرنے پر مجبور ہونا پڑتا تھا۔ صارفین کو استدلال کی گہرائی بھی دستی طور پر سیٹ کرنی پڑتی تھی، جس سے ایک سادہ پرامپٹ آزمائش اور غلطی (trial-and-error) کے کھیل میں بدل جاتا تھا۔ کیش ریڈ (cache-read) کے چارجز نے طویل سیشنز اور بار بار ٹول کالز کو مہنگا بنا دیا تھا، اور سیکیورٹی ٹیموں نے غلط مثبت (false-positive) وارننگز کی بھرمار کی شکایت کی تھی جس سے کوڈ ریویو کا عمل سست ہو جاتا تھا۔
Claude Fable 5.1 اور Claude Mythos 5.1 ان مسائل کا براہ راست حل پیش کرتے ہیں۔ ان کا بنیادی دماغ ایک ہی ہے، لیکن Anthropic اپنے ہدف والے سامعین کے لیے ہر ماڈل پر مختلف حفاظتی اقدامات (guardrails) لاگو کرتا ہے۔
یہ تبدیلیاں اصل میں کیا کرتی ہیں
- کم لاگت – Anthropic نے کیش ریڈز کی قیمت کم کر دی ہے، اس لیے اب طویل اور بار بار ہونے والی کوڈنگ سیشنز اور ٹول کالز کی لاگت نمایاں طور پر کم ہے—جو اسٹارٹ اپس اور ان ہاؤس ڈویلپمنٹ ٹیموں کے لیے ایک فیصلہ کن عنصر ہے۔
- موافقت پذیر سوچ (Adaptive thinking) – ماڈل خود فیصلہ کرتا ہے کہ کسی کام کے لیے کتنے استدلال کی ضرورت ہے۔ صارفین کو اب "ایفورت لیولز" (effort levels) کو تبدیل کرنے یا یہ اندازہ لگانے کی ضرورت نہیں کہ کتنے chain-of-thought پرامپٹنگ کی ضرورت ہے۔
- ٹرن اسکوپڈ پیغامات (Turn-scoped messages) – سسٹم لیول کی ہدایات صرف ایک تبادلے تک محدود ہوتی ہیں، جس سے پرانی ہدایات بعد کے تبادلے میں مداخلت نہیں کر پاتیں۔
- سیکیورٹی میں بہتری – Claude Code صارفین سائبر سیکیورٹی کے تقریباً 60% کم غلط مثبت (false positives) نتائج کی اطلاع دے رہے ہیں، جس سے فرضی وارننگز کے پیچھے ضائع ہونے والا وقت بچ رہا ہے۔
- کمزوریوں کی نشاندہی (Vulnerability detection) – Fable 5.1 سافٹ ویئر کی خامیوں کو پہچانتا ہے لیکن اسے ایکسپلائٹ کوڈ (exploit code) تیار کرنے سے روک دیا گیا ہے، تاکہ آڈیٹرز کی کارکردگی متاثر نہ ہو اور بدنیتی پر مبنی عناصر کے لیے راستہ بھی نہ کھلے۔
- اعلیٰ درجے کی تحقیق پر توجہ – Mythos 5.1 سائبر سیکیورٹی اور لائف سائنسز کے قابل اعتماد پروگراموں کے لیے کام کرتا ہے۔ Anthropic اسے سائفر ڈیزائن (cipher design) جیسے کاموں پر سخت آزمائش کے مراحل سے گزارتا ہے، اور پھر ان معلومات کو عام مقصد کے لیے استعمال ہونے والے Fable ماڈل میں شامل کر دیتا ہے۔
کس کو فائدہ ہوگا اور کون پیچھے رہ سکتا ہے
IDE اسسٹنٹ، CI پائپ لائنز یا کسٹم بوٹس بنانے والے ڈویلپرز کے پیسے بچیں گے اور انہیں سیکیورٹی کی کم پریشانیاں ہوں گی۔ سیکیورٹی تجزیہ کار اور بائیوٹیک محققین جو Anthropic کے اعتماد کے معیار پر پورا اترتے ہیں، وہ حساس کاموں کے لیے Mythos 5.1 کے سخت حفاظتی اقدامات سے فائدہ اٹھا سکتے ہیں۔ اس کا نقصان یہ ہے کہ Mythos عام عوام کے لیے بند رہے گا، اس لیے وہ چھوٹی ٹیمیں جن کا قابل اعتماد پروگرام کے ساتھ تعلق نہیں ہے، انہیں زیادہ نرم Fable 5.1 پر انحصار کرنا ہوگا۔
ممکنہ نقصانات یا کھلے سوالات
ایکسپلائٹ جنریشن (exploit generation) پر پابندی ان ریڈ ٹیم (red-team) صارفین کو مایوس کر سکتی ہے جنہیں دفاع کی جانچ کے لیے حقیقت پسندانہ حملے والے کوڈ کی ضرورت ہوتی ہے۔ "قابل اعتماد پروگرام" کا گیٹ AI مارکیٹ میں طبقاتی نظام پیدا کر سکتا ہے، جہاں صرف اچھی طرح سے فنڈڈ تنظیمیں ہی سب سے زیادہ محفوظ اور اعلیٰ صلاحیت والے ماڈل حاصل کر سکیں گی۔ اگرچہ کیش ریڈ کی قیمتوں میں کمی آئی ہے، لیکن Anthropic نے مکمل لاگت کا ماڈل ظاہر نہیں کیا ہے، جس سے ڈویلپرز بڑے پیمانے کے کاموں کے لیے خالص بچت کے بارے میں غیر یقینی کا شکار ہیں۔
آگے کیا دیکھنا ہے
اپنائے جانے کی شرح (Adoption rates) سے پتہ چلے گا کہ آیا لاگت اور سیکیورٹی کے وعدے حقیقی دنیا میں پیداواری صلاحیت میں اضافے میں تبدیل ہوتے ہیں یا نہیں۔ اگر ڈویلپرز بڑے کوڈ بیسز کے لیے 1 ملین ٹوکن ونڈو کو ترجیح دیتے ہیں، تو Anthropic پر Mythos لیول کے حفاظتی اقدامات کو وسیع تر سامعین کے لیے کھولنے کا دباؤ آ سکتا ہے۔ حملوں کے دوران نیا سیکیورٹی ڈھانچہ کتنا برقرار رہتا ہے، اس کا اندازہ لگانے کے لیے غلط مثبت نتائج میں کمی کی تعدد اور کمزوریوں کو اسکین کرنے والے پائپ لائنز پر اس کے اثرات پر نظر رکھیں۔
خلاصہ: Claude Fable 5.1 اور Claude Mythos 5.1 کا مقصد صرف بینچ مارکس توڑنا نہیں بلکہ طویل عرصے تک چلنے والے AI ورک فلو کی لاگت کم کرنا اور انتہائی حساس ایپلی کیشنز کے لیے حفاظتی جال کو مزید مضبوط بنانا ہے۔
