OpenAI نے 30 جولائی 2026 کو اعلان کیا کہ GPT-5.6 API کی قیمت اس کے پچھلے ورژن کے مقابلے میں بہت کم ہوگی، جس میں تین مختلف سطحوں والے ماڈلز—Sol، Terra اور Luna—اور کیش شدہ (cached) ریڈز کے لیے بھاری ڈسکاؤنٹ متعارف کرائے گئے ہیں۔

نئی قیمتوں کی اہمیت کیوں ہے

GPT-5 کے آغاز کے بعد سے، API کے اخراجات ان تمام لوگوں کے لیے ایک بڑا خرچہ رہے ہیں جو بات چیت کرنے والے ایجنٹس (conversational agents)، ریٹریول آگمینٹڈ جنریشن (RAG) پائپ لائنز یا بڑے پیمانے پر ڈیٹا نکالنے والے ٹولز بنا رہے ہیں۔ Sol، Terra اور Luna کے لیے ان پٹ فیس کو بالترتیب 5 ڈالر، 2 ڈالر اور 0.20 ڈالر فی ملین ٹوکن تک کم کر کے، OpenAI ڈویلپرز کو اپنے پورے سسٹم کو دوبارہ ڈیزائن کیے بغیر ضرورت کے مطابق ریژوننگ (reasoning) کا لیول منتخب کرنے کا ایک سستا طریقہ فراہم کرتا ہے۔ سب سے زیادہ بچت Terra میں نظر آتی ہے، جو اب پرانی فلیگ شپ قیمت کے 40% پر چلتی ہے، اور Luna میں، جو اس معیار کے محض 4% پر ہے۔

تین ماڈلز کی تفصیل

ماڈل ان پٹ قیمت (فی 1 ملین ٹوکن) آؤٹ پٹ قیمت (فی 1 ملین ٹوکن) عام استعمال
Sol $5 $30 گہری ریژوننگ، چین آف تھاٹ ٹاسک
Terra $2 $12 پروڈکشن ورک لوڈز، متوازن کارکردگی
Luna $0.20 $1.20 زیادہ حجم، سادہ ڈیٹا نکالنا یا درجہ بندی

Sol اب بھی سب سے مہنگا ہے لیکن یہ بہترین ریژوننگ گہرائی فراہم کرتا ہے۔ Terra کو زیادہ تر ایپلی کیشنز کے لیے ڈیفالٹ کے طور پر رکھا گیا ہے، جبکہ Luna ایک "ہائی اسکیل" آپشن ہے جہاں لاگت بچانے کے لیے گہرائی پر سمجھوتہ کیا جا سکتا ہے۔

کیشنگ سے بل مزید کم ہو جاتا ہے

OpenAI نے ایک کیشنگ لیئر متعارف کرائی ہے جو ریڈ آپریشنز (read operations) پر 90% ڈسکاؤنٹ دیتی ہے۔ کیش شدہ ان پٹ کے نرخ یہ ہیں:

  • Sol: $0.50 / ملین ٹوکن
  • Terra: $0.20 / ملین ٹوکن
  • Luna: $0.02 / ملین ٹوکن

کیش میں لکھنے (writes) کی قیمت متعلقہ ان پٹ ریٹ سے 1.25 گنا زیادہ ہے، اور کیش انٹری کو ہٹائے جانے سے پہلے کم از کم 30 منٹ تک برقرار رہنا ضروری ہے۔

کانٹیکسٹ لینتھ (Context-length) سرچارجز

اب API اس وقت سرچارج عائد کرتی ہے جب کوئی درخواست 272 K ٹوکنز سے زیادہ ان پٹ پر مشتمل ہو۔ ان پٹ کے لیے بنیادی قیمت دوگنی ہو جاتی ہے اور آؤٹ پٹ کے لیے 1.5 گنا بڑھ جاتی ہے۔ Sol کے اوور ایج (overage) نرخات $10 ان پٹ اور $45 آؤٹ پٹ فی ملین ٹوکن درج ہیں، جس سے غیر معمولی طور پر طویل کانٹیکسٹ کے لیے جرمانے کا حساب لگانا آسان ہو جاتا ہے۔

ڈویلپرز کو کیا نقصان ہے

قیمتوں میں کمی کے ساتھ دو اہم چیزیں نظر انداز کی گئی ہیں۔ پہلا یہ کہ کوئی مستقل فری ٹائر (free tier) نہیں ہے، جس کا مطلب ہے کہ ہر درخواست پر، چاہے وہ کتنی ہی چھوٹی کیوں نہ ہو، چارجز لاگو ہوں گے۔ دوسرا یہ کہ OpenAI نے ابھی تک GPT-5.6 کے لیے بیچ اینڈ پوائنٹ (batch-endpoint) ڈسکاؤنٹس متعارف نہیں کرائے، جو کہ ایک ایسا فیچر تھا جس نے پچھلے ورژنز میں بڑے پیمانے پر استعمال کرنے والوں کو فی کال لاگت کم کرنے میں مدد دی تھی۔

اخراجات کو کم کیسے رکھیں

  • صحیح ماڈل کا انتخاب کریں: Sol کو صرف ان کاموں کے لیے استعمال کریں جن کے لیے واقعی گہری ریژوننگ کی ضرورت ہو؛ زیادہ تر پروڈکشن کاموں کے لیے Terra کو ڈیفالٹ رکھیں؛ Luna کو زیادہ حجم اور کم پیچیدگی والے کاموں کے لیے مخصوص کریں۔
  • کیشنگ کا استعمال کریں: ان پرامپٹس (prompts) اور درمیانی نتائج کو محفوظ کریں جنہیں بار بار استعمال کیا جاتا ہے؛ 90% ریڈ ڈسکاؤنٹ بنیادی قیمت میں کمی سے کہیں زیادہ فائدہ مند ہو سکتا ہے۔
  • کانٹیکسٹ لینتھ کا خیال رکھیں: 2× ان پٹ سرچارج سے بچنے کے لیے بہت طویل ان پٹس کو چھوٹے حصوں میں تقسیم کریں یا غیر ضروری حصوں کو ختم کر دیں۔
  • کیش کی مدت پر نظر رکھیں: کیش کی کم از کم مدت 30 منٹ ہے۔

آگے کیا ہے

ڈویلپرز کو کسی بھی تبدیلی کے لیے آفیشل پرائسنگ پیج پر نظر رکھنی چاہیے، خاص طور پر کیش رائٹ فیس یا کانٹیکسٹ لینتھ کی حد کے حوالے سے۔

خلاصہ: GPT-5.6 کی مختلف سطحوں والی قیمتیں اور جارحانہ کیشنگ ڈسکاؤنٹس اسے ایک سستا OpenAI ماڈل بناتے ہیں، لیکن فری ٹائر اور بیچ ڈسکاؤنٹس کی کمی کا مطلب ہے کہ کسی بھی بڑے پیمانے پر استعمال کے لیے ہوشیارانہ لاگت کا انتظام اب بھی ضروری ہوگا۔