OpenAI GPT-5.6 Sol શ્રેષ્ઠ કાર્યક્ષમતા સાથે Fable 5 ને પડકાર આપે છે
OpenAI એ GPT-5.6 Sol ના வெளியાદે સત્તાવાર રીતે ફ્રન્ટિયર મોડલ હાયરાર્કીમાં મોટો ફેરફાર કર્યો છે, જે એક ફ્લેગશિપ મોડલ છે જે અલ્પ ખર્ચમાં સમાન સ્તરની બુદ્ધિ પ્રદાન કરે છે. પર્ફોર્મન્સ અને કિંમત વચ્ચેના સંબંધને શ્રેષ્ઠ બનાવことで, OpenAI એજન્ટિક વર્કફ્લો અને એન્ટરપ્રાઇઝ-સ્કેલ ડિપ્લોયમેન્ટ માટે એક નવો માપદંડ સ્થાપિત કરી રહ્યું છે.
બેન્ચમાર્ક તોડતા: કોડિંગમાં પ્રભુત્વ અને બુદ્ધિની સમાનતા
સ્વતંત્ર મૂલ્યાંકન પ્લેટફોર્મ Artificial Analysis ના નવા ડેટા દર્શાવે છે કે GPT-5.6 Sol (max) એ Anthropic ના ટોપ-ટિયર મોડલ્સને સખત સ્પર્ધા આપી રહ્યું છે. ઇન્ટેલિજન્સ ઇન્ડેક્સ પર, Sol એ 59 પોઈન્ટ્સ મેળવ્યા છે, જે Claude Fable 5 થી માત્ર એક પોઈન્ટ પાછળ છે. આ તેને Claude Opus 4.8 (56 પોઈન્ટ્સ) અને GPT-5.6 Terra (55 પોઈન્ટ્સ) જેવા અન્ય મજબૂત મોડલ્સ કરતા આગળ રાખે છે.
જોકે Fable 5 સામાન્ય બુદ્ધિમાં થોડો ફાયદો ધરાવે છે, પરંતુ OpenAI એ વિશિષ્ટ ક્ષેત્રોમાં સ્પષ્ટ વિજય મેળવ્યો છે. નવા Coding Agent Index માં, OpenAI ના Codex એન્વાયરમેન્ટમાં ચાલતી વખતે GPT-5.6 Sol એ 80 પોઈન્ટ્સ સાથે પ્રથમ સ્થાન મેળવ્યું હતું, જે GPT-5.6 Terra (77 પોઈન્ટ્સ) અને Claude Fable 5 (77 પોઈન્ટ્સ) બંને કરતા વધુ સારું પ્રદર્શન કરે છે. વધુમાં, AA-Briefcase બેન્ચમાર્ક—જે વાસ્તવિક ઓફિસ કાર્યો પરના પ્રદર્શનને માપે છે—તેમાં Sol એ તમામ પરીક્ષિત મોડલ્સમાં સૌથી વધુ "Presentation Elo" હાંસલ કર્યું છે.
નવું Pareto Frontier: ખર્ચમાં ધરખમ ઘટાડો
GPT-5.6 ના રિલીઝની સૌથી નોંધપાત્ર અસર તેની આર્થિક કાર્યક્ષમતામાં રહેલી છે. Artificial Analysis નોંધે છે કે Sol "Intelligence vs Output Tokens per Task નો નવો Pareto frontier વ્યાખ્યાયિત કરે છે." જ્યારે Claude Fable 5 ની કિંમત પ્રતિ કાર્ય આશરે $2.75 છે, ત્યારે GPT-5.6 Sol માત્ર $1.04 માં સમાન સ્તરે કામ કરે છે—જે અંદાજે ત્રીજા ભાગની કિંમત છે.
OpenAI એ વિવિધ સ્તરની જટિલતાઓને પહોંચી વળવા માટે એક સ્તરિત (tiered) ઇકોસિસ્ટમ પણ રજૂ કરી છે:
- GPT-5.6 Sol: $5 પ્રતિ મિલિયન ઇનપુટ ટોકન્સ / $30 પ્રતિ મિલિયન આઉટપુટ ટોકન્સ.
- GPT-5.6 Terra: $2.50 પ્રતિ મિલિયન ઇનપુટ / $15 પ્રતિ મિલિયન આઉટપુટ (Sol કરતા 50% સસ્તું).
- GPT-5.6 Luna: $1 પ્રતિ મિલિયન ઇનપુટ / $6 પ્રતિ મિલિયન આઉટપુટ (Sol કરતા 80% સસ્તું).
પુનરાવર્તિત વર્કફ્લો માટે લેટન્સી અને ખર્ચને વધુ ઘટાડવા માટે, OpenAI એ કેશ-રાઈટ ફી (cache-write fee) રજૂ કરી છે અને કેશ રીડ્સ (cache reads) પર 90% નો મોટો ડિસ્કાઉન્ટ આપ્યો છે. વધુમાં, CEO Sam Altman એ નોંધ્યું હતું કે Sol ટોકન વપરાશમાં નોંધપાત્ર રીતે વધુ કાર્યક્ષમ છે, જે સમાન મોડલ્સની સરખામણીમાં એજન્ટિક કોડિંગ કાર્યો માટે 54% સુધી ઓછા આઉટપુટ ટોકન્સનો ઉપયોગ કરે છે.
વધતી જતી વૈશ્વિક કિંમત યુદ્ધ
આ રિલીઝ AI આર્મ્સ રેસમાં એક વ્યૂહાત્મક ફેરફાર સૂચવે છે. જેમ જેમ ચાઈનીઝ ઓપન-સોર્સ મોડલ્સ, Meta ના Muse 1.1, અને xAI ના Grok 4.5 માર્જિન પર દબાણ લાવે છે, તેમ OpenAI હવે માત્ર કાચી બુદ્ધિ (raw intelligence) પર જ સ્પર્ધા નથી કરી રહ્યું—તે યુનિટ ઇકોનોમિક્સ પર સ્પર્ધા કરી રહ્યું છે.
પર્ફોર્મન્સ અને કિંમત બંને બાબતે Anthropic પર દબાણ લાવીને, OpenAI સમગ્ર બજારમાં પરિવર્તન લાવવા મજબૂર કરી રહ્યું છે. જોકે કિંમતોમાં આ "race to the bottom" એજન્ટિક એપ્લિકેશન્સ સ્કેલ કરવા માંગતા ડેવલપર્સ અને ફાઉન્ડર્સ માટે ફાયદાકારક છે, પરંતુ તે એક તીવ્ર સ્પર્ધાત્મક વાતાવરણ બનાવે છે જે નક્કી કરશે કે લાંબા ગાળે કઈ AI લેબ્સ ટકાઉ રહેશે.
મુખ્ય મુદ્દાઓ
- પર્ફોર્મન્સ પેરિટી: GPT-5.6 Sol ઇન્ટેલિજન્સ ઇન્ડેક્સ પર Claude Fable 5 ને એક પોઈન્ટના અંતર સાથે મેચ કરે છે અને 80 પોઈન્ટ્સ સાથે કોડિંગ એજન્ટ ઇન્ડેક્સ પર પ્રભુત્વ ધરાવે છે.
- આર્થિક ડિસરપ્શન: Sol, Fable 5 ના ત્રીજા ભાગના ખર્ચમાં ($1.04 વિરુદ્ધ $2.75 પ્રતિ કાર્ય) ફ્રન્ટિયર સ્તરની બુદ્ધિ પ્રદાન કરે છે.
- એજન્ટિક કાર્યક્ષમતા: કેશ રીડ્સ પર 90% ડિસ્કાઉન્ટ અને કોડિંગ માટે 54% ઓછા આઉટપુટ ટોકન્સ સહિતના નવા ઓપ્ટિમાઇઝેશન, Sol ને સ્વાયત્ત એજન્ટ્સ (autonomous agents) માટે અત્યંત કાર્યક્ષમ બનાવે છે.
