OpenAI GPT-5.6 Sol ने बेहतर दक्षता के साथ Fable 5 को चुनौती दी

OpenAI ने GPT-5.6 Sol की रिलीज़ के साथ आधिकारिक तौर पर फ्रंटियर मॉडल पदानुक्रम (hierarchy) को बाधित कर दिया है, जो एक फ्लैगशिप मॉडल है और बहुत कम लागत पर लगभग समान बुद्धिमत्ता (intelligence) प्रदान करता है। प्रदर्शन और मूल्य निर्धारण के बीच संबंध को अनुकूलित करके, OpenAI एजेंटिक वर्कफ़्लो (agentic workflows) और एंटरप्राइज़-स्केल पर तैनाती के लिए एक नया मानक स्थापित कर रहा है।

बेंचमार्क तोड़ना: कोडिंग में दबदबा और इंटेलिजेंस समानता

स्वतंत्र मूल्यांकन प्लेटफॉर्म Artificial Analysis के नए डेटा से पता चलता है कि GPT-5.6 Sol (max), Anthropic के टॉप-टियर मॉडल्स को कड़ी टक्कर दे रहा है। इंटेलिजेंस इंडेक्स पर, Sol ने 59 अंकों का स्कोर हासिल किया, जो Claude Fable 5 से मात्र एक अंक पीछे है। यह इसे Claude Opus 4.8 (56 अंक) और GPT-5.6 Terra (55 अंक) जैसे अन्य दिग्गजों से आगे रखता है।

हालांकि Fable 5 समग्र सामान्य बुद्धिमत्ता में थोड़ा बढ़त बनाए हुए है, लेकिन OpenAI ने विशिष्ट क्षेत्रों (specialized domains) में स्पष्ट जीत हासिल की है। नए Coding Agent Index में, OpenAI के Codex एनवायरनमेंट में चलने पर GPT-5.6 Sol ने 80 अंकों के साथ शीर्ष स्थान प्राप्त किया, जो GPT-5.6 Terra (77 अंक) और Claude Fable 5 (77 अंक) दोनों से बेहतर है। इसके अतिरिक्त, AA-Briefcase बेंचमार्क में—जो वास्तविक कार्यालय कार्यों पर प्रदर्शन को मापता है—Sol ने सभी परीक्षण किए गए मॉडलों में उच्चतम "Presentation Elo" हासिल किया।

नया Pareto Frontier: लागत में भारी कमी

GPT-5.6 रिलीज़ का सबसे महत्वपूर्ण प्रभाव इसकी आर्थिक दक्षता में निहित है। Artificial Analysis का कहना है कि Sol "इंटेलिजेंस बनाम प्रति कार्य आउटपुट टोकन का एक नया Pareto frontier परिभाषित करता है।" जबकि Claude Fable 5 की लागत प्रति कार्य लगभग $2.75 है, GPT-5.6 Sol केवल $1.04 में तुलनीय स्तर पर प्रदर्शन करता है—जो लगभग एक-तिहाई कीमत है।

OpenAI ने विभिन्न स्तरों की जटिलता को पूरा करने के लिए एक टियर वाला इकोसिस्टम भी पेश किया है:

  • GPT-5.6 Sol: $5 प्रति मिलियन इनपुट टोकन / $30 प्रति मिलियन आउटपुट टोकन।
  • GPT-5.6 Terra: $2.50 प्रति मिलियन इनपुट / $15 प्रति मिलियन आउटपुट (Sol से 50% सस्ता)।
  • GPT-5.6 Luna: $1 प्रति मिलियन इनपुट / $6 प्रति मिलियन आउटपुट (Sol से 80% सस्ता)।

दोहराए जाने वाले वर्कफ़्लो के लिए लेटेंसी (latency) और लागत को और कम करने के लिए, OpenAI ने एक cache-write शुल्क पेश किया है और cache reads पर भारी 90% की छूट दी है। इसके अलावा, CEO Sam Altman ने उल्लेख किया कि Sol टोकन खपत में काफी अधिक कुशल है, जो समान मॉडलों की तुलना में एजेंटिक कोडिंग कार्यों के लिए 54% तक कम आउटपुट टोकन का उपयोग करता है।

तीव्र होती वैश्विक मूल्य युद्ध

यह रिलीज़ AI हथियारों की दौड़ (arms race) में एक रणनीतिक बदलाव का संकेत देती है। जैसे-जैसे चीनी ओपन-सोर्स मॉडल, Meta का Muse 1.1, और xAI का Grok 4.5 मार्जिन पर दबाव डाल रहे हैं, OpenAI अब केवल कच्ची बुद्धिमत्ता (raw intelligence) पर प्रतिस्पर्धा नहीं कर रहा है—यह यूनिट इकोनॉमिक्स (unit economics) पर प्रतिस्पर्धा कर रहा है।

प्रदर्शन और कीमत दोनों पर Anthropic को दबाकर, OpenAI पूरे बाजार में विकास (evolution) के लिए मजबूर कर रहा है। हालांकि मूल्य निर्धारण पर यह "race to the bottom" उन डेवलपर्स और संस्थापकों को लाभ पहुँचाता है जो एजेंटिक एप्लिकेशन को स्केल करना चाहते हैं, लेकिन यह एक तीव्र प्रतिस्पर्धी परिदृश्य बनाता है जो यह तय करेगा कि कौन सी AI लैब लंबे समय तक टिकाऊ रहेगी।

मुख्य बातें (Key Takeaways)

  • प्रदर्शन समानता: GPT-5.6 Sol इंटेलिजेंस इंडेक्स पर Claude Fable 5 के साथ एक अंक के भीतर मेल खाता है और 80 अंकों के साथ Coding Agent Index पर दबदबा बनाता है।
  • आर्थिक व्यवधान: Sol, Fable 5 की तुलना में एक-तिहाई लागत ($1.04 बनाम $2.75 प्रति कार्य) पर लगभग फ्रंटियर इंटेलिजेंस प्रदान करता है।
  • एजेंटिक दक्षता: नए अनुकूलन, जिसमें cache reads पर 90% की छूट और कोडिंग के लिए 54% कम आउटपुट टोकन शामिल हैं, Sol को स्वायत्त एजेंटों (autonomous agents) के लिए अत्यधिक अनुकूलित बनाते हैं।