OpenAI GPT-5.6 Sol نے برتری والی کارکردگی کے ساتھ Fable 5 کو چیلنج کر دیا

OpenAI نے GPT-5.6 Sol کے اجرا کے ساتھ فرنٹیر ماڈل کی درجہ بندی میں باضابطہ طور پر تبدیلی لا دی ہے، یہ ایک فلیگ شپ ماڈل ہے جو بہت کم قیمت پر تقریباً برابر کی ذہانت فراہم کرتا ہے۔ کارکردگی اور قیمت کے درمیان تعلق کو بہتر بنا کر، OpenAI ایجنٹک ورک فلو (agentic workflows) اور انٹرپرائز اسکیل ڈیپلائمنٹ کے لیے ایک نیا معیار قائم کر رہا ہے۔

بینچ مارکس کو توڑنا: کوڈنگ پر غلبہ اور ذہانت میں برابری

آزادانہ جانچ پڑتال کے پلیٹ فارم Artificial Analysis سے حاصل ہونے والے نئے ڈیٹا سے پتہ چلتا ہے کہ GPT-5.6 Sol (max) Anthropic کے اعلیٰ درجے کے ماڈلز کے بالکل قریب پہنچ چکا ہے۔ Intelligence Index پر، Sol نے 59 پوائنٹس حاصل کیے، جو Claude Fable 5 سے محض ایک پوائنٹ پیچھے ہے۔ یہ اسے Claude Opus 4.8 (56 پوائنٹس) اور GPT-5.6 Terra (55 پوائنٹس) جیسے دیگر بڑے کھلاڑیوں سے آگے رکھتا ہے۔

اگرچہ Fable 5 مجموعی عمومی ذہانت میں تھوڑا برتر ہے، لیکن OpenAI نے مخصوص شعبوں میں واضح فتح حاصل کر لی ہے۔ نئے Coding Agent Index میں، OpenAI کے Codex ماحول میں چلتے ہوئے GPT-5.6 Sol نے 80 پوائنٹس کے ساتھ پہلی پوزیشن حاصل کی، جو GPT-5.6 Terra (77 پوائنٹس) اور Claude Fable 5 (77 پوائنٹس) دونوں سے بہتر کارکردگی کا مظاہرہ کرتا ہے۔ مزید برآں، AA-Briefcase بینچ مارک میں—جو حقیقت پسندانہ دفتری کاموں پر کارکردگی کی پیمائش کرتا ہے—Sol نے تمام آزمائے گئے ماڈلز میں سب سے زیادہ "Presentation Elo" حاصل کیا۔

نیا Pareto Frontier: لاگت میں نمایاں کمی

GPT-5.6 کے اجرا کا سب سے اہم اثر اس کی معاشی کارکردگی میں ہے۔ Artificial Analysis کے مطابق Sol "ذہانت بمقابلہ فی ٹاسک آؤٹ پٹ ٹوکنز کا ایک نیا Pareto frontier متعین کرتا ہے۔" جہاں Claude Fable 5 کی قیمت فی ٹاسک تقریباً $2.75 ہے، وہیں GPT-5.6 Sol صرف $1.04 میں اسی سطح کی کارکردگی دکھاتا ہے—جو کہ قیمت کا تقریباً ایک تہائی ہے۔

OpenAI نے مختلف سطح کی پیچیدگیوں کو پورا کرنے کے لیے ایک درجہ بندی شدہ (tiered) ایکو سسٹم بھی متعارف کرایا ہے:

  • GPT-5.6 Sol: $5 فی ملین ان پٹ ٹوکنز / $30 فی ملین آؤٹ پٹ ٹوکنز۔
  • GPT-5.6 Terra: $2.50 فی ملین ان پٹ / $15 فی ملین آؤٹ پٹ (Sol سے 50% سستا)۔
  • GPT-5.6 Luna: $1 فی ملین ان پٹ / $6 فی ملین آؤٹ پٹ (Sol سے 80% سستا)۔

بار بار ہونے والے ورک فلو کے لیے لیٹنسی (latency) اور لاگت کو مزید کم کرنے کے لیے، OpenAI نے cache-write فیس متعارف کرائی ہے اور cache reads پر 90% کی بھاری رعایت دی ہے۔ مزید برآں، CEO Sam Altman نے نوٹ کیا کہ Sol ٹوکن کے استعمال میں نمایاں طور پر زیادہ موثر ہے، جو کہ اسی طرح کے ماڈلز کے مقابلے میں ایجنٹک کوڈنگ ٹاسک کے لیے 54% تک کم آؤٹ پٹ ٹوکنز استعمال کرتا ہے۔

بڑھتی ہوئی عالمی قیمتوں کی جنگ

یہ ریلیز AI کی ہتھیاروں کی دوڑ (arms race) میں ایک اسٹریٹجک تبدیلی کا اشارہ دیتی ہے۔ جیسے جیسے چینی اوپن سورس ماڈلز، Meta کا Muse 1.1، اور xAI کا Grok 4.5 مارجنز پر دباؤ ڈال رہے ہیں، OpenAI اب صرف خام ذہانت پر مقابلہ نہیں کر رہا—بلکہ یہ یونٹ اکنامکس (unit economics) پر مقابلہ کر رہا ہے۔

کارکردگی اور قیمت دونوں پر Anthropic کو دباؤ میں لا کر، OpenAI پورے مارکیٹ میں ارتقاء کے لیے مجبور کر رہا ہے۔ اگرچہ قیمتوں میں یہ "race to the bottom" ان ڈویلپرز اور فاؤنڈرز کے لیے فائدہ مند ہے جو ایجنٹک ایپلی کیشنز کو وسعت دینا چاہتے ہیں، لیکن یہ ایک شدید مسابقتی منظر نامہ پیدا کرتا ہے جو یہ طے کرے گا کہ طویل مدت میں کون سے AI لیبز پائیدار رہیں گے۔

اہم نکات

  • کارکردگی میں برابری: GPT-5.6 Sol Intelligence Index پر Claude Fable 5 کے ساتھ ایک پوائنٹ کے فرق کے اندر مقابلہ کرتا ہے اور 80 پوائنٹس کے ساتھ Coding Agent Index پر غلبہ رکھتا ہے۔
  • معاشی تبدیلی: Sol، Fable 5 کی لاگت کے ایک تہائی پر (فی ٹاسک $1.04 بمقابلہ $2.75) فرنٹیر کے قریب ذہانت فراہم کرتا ہے۔
  • ایجنٹک کارکردگی: نئی بہتری، بشمول cache reads پر 90% رعایت اور کوڈنگ کے لیے 54% کم آؤٹ پٹ ٹوکنز، Sol کو خود مختار ایجنٹس (autonomous agents) کے لیے انتہائی موزوں بناتی ہے۔