OpenAI GPT-5.6 Sol ने उत्कृष्ट कार्यक्षमतेसह Fable 5 ला आव्हान दिले

OpenAI ने GPT-5.6 Sol च्या प्रकाशनाद्वारे अधिकृतपणे फ्रंटियर मॉडेल श्रेणीमध्ये मोठी क्रांती घडवून आणली आहे. हे एक फ्लॅगशिप मॉडेल असून ते अत्यंत कमी खर्चात जवळपास समान बुद्धिमत्ता (near-parity intelligence) प्रदान करते. कार्यक्षमता आणि किंमत यांच्यातील संबंधांचे ऑप्टिमायझेशन करून, OpenAI आता 'एजेंटिक वर्कफ्लो' (agentic workflows) आणि एंटरप्राइझ-स्केल उपयोजनांसाठी एक नवीन मानक प्रस्थापित करत आहे.

बेंचमार्क तोडणे: कोडिंगमधील वर्चस्व आणि बुद्धिमत्तेची समानता

स्वतंत्र मूल्यमापन प्लॅटफॉर्म 'Artificial Analysis' कडून मिळालेल्या नवीन डेटावरून असे दिसून येते की, GPT-5.6 Sol (max) हे Anthropic च्या उच्च-स्तरीय मॉडेल्सच्या अगदी जवळ पोहोचले आहे. 'Intelligence Index' वर, Sol ने ५९ गुण मिळवले आहेत, जे Claude Fable 5 पेक्षा केवळ एक गुण कमी आहेत. यामुळे हे मॉडेल Claude Opus 4.8 (५६ गुण) आणि GPT-5.6 Terra (५५ गुण) सारख्या इतर दिग्गज मॉडेल्सच्या पुढे आहे.

जरी Fable 5 ने एकूण सामान्य बुद्धिमत्तेमध्ये थोडी आघाडी कायम ठेवली असली, तरी OpenAI ने विशेष क्षेत्रांमध्ये (specialized domains) स्पष्ट विजय मिळवला आहे. नवीन 'Coding Agent Index' मध्ये, OpenAI च्या Codex वातावरणात चालताना GPT-5.6 Sol ने ८० गुणांसह अव्वल स्थान पटकावले, ज्यामध्ये त्याने GPT-5.6 Terra (७७ गुण) आणि Claude Fable 5 (७७ गुण) या दोघांनाही मागे टाकले. याव्यतिरिक्त, AA-Briefcase बेंचमार्कमध्ये—जो वास्तववादी कार्यालयीन कामांवरील कामगिरी मोजतो—Sol ने सर्व चाचणी घेतलेल्या मॉडेल्समध्ये सर्वाधिक "Presentation Elo" प्राप्त केले.

नवीन Pareto Frontier: खर्चात मोठी कपात

GPT-5.6 च्या प्रकाशनाचा सर्वात महत्त्वाचा प्रभाव त्याच्या आर्थिक कार्यक्षमतेमध्ये आहे. Artificial Analysis ने नमूद केले आहे की, Sol "Intelligence vs Output Tokens per Task चा एक नवीन Pareto frontier निश्चित करते." जिथे Claude Fable 5 ची किंमत प्रति कार्य अंदाजे $२.७५ आहे, तिथे GPT-5.6 Sol केवळ $१.०४ मध्ये तुलनीय पातळीवर काम करते—जे किमतीच्या साधारण एक तृतीयांश आहे.

OpenAI ने विविध स्तरांवरील जटिलतेसाठी एक टियर्ड इकोसिस्टम (tiered ecosystem) देखील सादर केली आहे:

  • GPT-5.6 Sol: प्रति दशलक्ष इनपुट टोकन्स $५ / प्रति दशलक्ष आउटपुट टोकन्स $३०.
  • GPT-5.6 Terra: प्रति दशलक्ष इनपुट $२.५० / प्रति दशलक्ष आउटपुट $१५ (Sol पेक्षा ५०% स्वस्त).
  • GPT-5.6 Luna: प्रति दशलक्ष इनपुट $१ / प्रति दशलक्ष आउटपुट $६ (Sol पेक्षा ८०% स्वस्त).

पुनरावृत्ती होणाऱ्या वर्कफ्लोसाठी लॅटन्सी (latency) आणि खर्च अधिक कमी करण्यासाठी, OpenAI ने 'cache-write fee' सुरू केली आहे आणि 'cache reads' वर ९०% सवलत दिली आहे. शिवाय, CEO Sam Altman यांनी नमूद केले की, Sol टोकन वापरामध्ये लक्षणीयरीत्या अधिक कार्यक्षम आहे; ते तत्सम मॉडेल्सच्या तुलनेत एजेंटिक कोडिंग कामांसाठी ५४% पर्यंत कमी आउटपुट टोकन्स वापरते.

तीव्र होत असलेले जागतिक किंमत युद्ध

हे प्रकाशन AI शस्त्रास्त्रांच्या शर्यतीत (arms race) एक धोरणात्मक बदल दर्शवते. चिनी ओपन-सोर्स मॉडेल्स, Meta चे Muse 1.1 आणि xAI चे Grok 4.5 यांच्यामुळे मार्जिनवर दबाव येत असताना, OpenAI आता केवळ कच्च्या बुद्धिमत्तेवर (raw intelligence) स्पर्धा करत नाहीये—तर ते युनिट इकॉनॉमिक्सवर (unit economics) स्पर्धा करत आहे.

कामगिरी आणि किंमत या दोन्ही आघाड्यांवर Anthropic ला मागे खेचून, OpenAI संपूर्ण बाजारपेठेतील उत्क्रांतीला भाग पाडत आहे. किमतीमधील ही "race to the bottom" एजेंटिक ॲप्लिकेशन्स स्केल करू इच्छिणाऱ्या डेव्हलपर्स आणि संस्थापकांना फायदेशीर ठरत असली, तरी यामुळे एक तीव्र स्पर्धात्मक वातावरण निर्माण होत आहे, जे दीर्घकाळात कोणते AI लॅब्स टिकून राहतील हे ठरवेल.

मुख्य निष्कर्ष

  • कामगिरीची समानता (Performance Parity): GPT-5.6 Sol ने Intelligence Index वर Claude Fable 5 शी केवळ एक गुणाने बरोबरी केली आहे आणि Coding Agent Index मध्ये ८० गुणांसह वर्चस्व गाजवले आहे.
  • आर्थिक क्रांती (Economic Disruption): Sol, Fable 5 च्या तुलनेत एक तृतीयांश खर्चात ($१.०४ विरुद्ध $२.७५ प्रति कार्य) फ्रंटियर दर्जाची बुद्धिमत्ता प्रदान करते.
  • एजेंटिक कार्यक्षमता (Agentic Efficiency): cache reads वर ९०% सवलत आणि कोडिंगसाठी ५४% कमी आउटपुट टोकन्स यांसारख्या नवीन ऑप्टिमायझेशनमुळे Sol स्वायत्त एजंट्ससाठी (autonomous agents) अत्यंत कार्यक्षम बनले आहे.