മികച്ച കാര്യക്ഷമതയോടെ Fable 5-നെ വെല്ലുവിളിക്കുന്നു OpenAI GPT-5.6 Sol

കുറഞ്ഞ ചിലവിൽ സമാനമായ ബുദ്ധിശക്തി പ്രദാനം ചെയ്യുന്ന ഫ്ലാഗ്ഷിപ്പ് മോഡലായ GPT-5.6 Sol പുറത്തിറക്കിക്കൊണ്ട് OpenAI ഔദ്യോഗികമായി ഫ്രോണ്ടിയർ മോഡൽ ശ്രേണിയെ മാറ്റിമറിച്ചു. പ്രകടനം (performance), വില എന്നിവ തമ്മിലുള്ള ബന്ധം മെച്ചപ്പെടുത്തുന്നതിലൂടെ, ഏജന്റിക് വർക്ക്ഫ്ലോകൾക്കും (agentic workflows) എന്റർപ്രൈസ് തലത്തിലുള്ള വിന്യാസങ്ങൾക്കും (enterprise-scale deployment) പുതിയൊരു മാനദണ്ഡം OpenAI നിശ്ചയിക്കുകയാണ്.

ബെഞ്ച്മാർക്കുകൾ തകർക്കുന്നു: കോഡിംഗിലെ ആധിപത്യവും ബുദ്ധിശക്തിയിലെ തുല്യതയും

സ്വതന്ത്ര മൂല്യനിർണ്ണയ പ്ലാറ്റ്‌ഫോമായ Artificial Analysis-ൽ നിന്നുള്ള പുതിയ വിവരങ്ങൾ പ്രകാരം, Anthropic-ന്റെ ഏറ്റവും മികച്ച മോഡലുകൾക്ക് തൊട്ടുപിന്നിലായി GPT-5.6 Sol (max) എത്തിക്കഴിഞ്ഞു. Intelligence Index-ൽ Sol 59 പോയിന്റ് നേടി, ഇത് Claude Fable 5-നേക്കാൽ വെറും ഒരു പോയിന്റ് മാത്രം കുറവാണ്. ഇത് Claude Opus 4.8 (56 പോയിന്റ്), GPT-5.6 Terra (55 പോയിന്റ്) തുടങ്ങിയ മറ്റ് കരുത്തുറ്റ മോഡലുകളെക്കാൾ മുന്നിലാക്കുന്നു.

മൊത്തത്തിലുള്ള പൊതു ബുദ്ധിശക്തിയിൽ (general intelligence) Fable 5 നേരിയ മുൻതൂക്കം നിലനിർത്തുന്നുണ്ടെങ്കിലും, പ്രത്യേക മേഖലകളിൽ (specialized domains) OpenAI വ്യക്തമായ വിജയം നേടിയിട്ടുണ്ട്. പുതിയ Coding Agent Index-ൽ, OpenAI-യുടെ Codex എൻവയോൺമെന്റിൽ പ്രവർത്തിക്കുമ്പോൾ GPT-5.6 Sol 80 പോയിന്റോടെ ഒന്നാം സ്ഥാനം നേടി; GPT-5.6 Terra (77 പോയിന്റ്), Claude Fable 5 (77 പോയിന്റ്) എന്നിവരെ ഇത് മറികടന്നു. കൂടാതെ, യഥാർത്ഥ ഓഫീസ് ജോലികളിലെ പ്രകടനം അളക്കുന്ന AA-Briefcase ബെഞ്ച്മാർക്കിൽ, പരീക്ഷിക്കപ്പെട്ട എല്ലാ മോഡലുകളിലും ഏറ്റവും ഉയർന്ന "Presentation Elo" Sol നേടി.

പുതിയ Pareto Frontier: വിപ്ലവകരമായ ചിലവ് കുറവ്

GPT-5.6 റിലീസിന്റെ ഏറ്റവും പ്രധാനപ്പെട്ട സ്വാധീനം അതിന്റെ സാമ്പത്തിക കാര്യക്ഷമതയിലാണ്. "ബുദ്ധിശക്തിയും ഓരോ ടാസ്ക്കിനായുള്ള ഔട്ട്പുട്ട് ടോക്കണുകളും തമ്മിലുള്ള പുതിയൊരു Pareto frontier Sol നിർവചിക്കുന്നു" എന്ന് Artificial Analysis നിരീക്ഷിക്കുന്നു. Claude Fable 5 ഒരു ടാസ്ക്കിന് ഏകദേശം $2.75 ചിലവാകുമ്പോൾ, GPT-5.6 Sol സമാനമായ നിലവാരത്തിൽ വെറും $1.04-ന് പ്രവർത്തിക്കുന്നു—അതായത് ഏകദേശം മൂന്നിലൊന്ന് വില മാത്രം.

വിവിധ സങ്കീർണ്ണതകൾക്കനുസരിച്ച് ഉപയോഗിക്കാൻ OpenAI ഒരു ടയർഡ് ഇക്കോസിസ്റ്റം (tiered ecosystem) അവതരിപ്പിച്ചു:

  • GPT-5.6 Sol: ഒരു ദശലക്ഷം ഇൻപുട്ട് ടോക്കണുകൾക്ക് $5 / ഒരു ദശലക്ഷം ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് $30.
  • GPT-5.6 Terra: ഒരു ദശലക്ഷം ഇൻപുട്ടിന് $2.50 / ഒരു ദശലക്ഷം ഔട്ട്പുട്ടിന് $15 (Sol-നേക്കാൾ 50% കുറവ്).
  • GPT-5.6 Luna: ഒരു ദശലക്ഷം ഇൻപുട്ടിന് $1 / ഒരു ദശലക്ഷം ഔട്ട്പുട്ടിന് $6 (Sol-നേക്കാൾ 80% കുറവ്).

ആവർത്തന സ്വഭാവമുള്ള വർക്ക്ഫ്ലോകളുടെ ലേറ്റൻസിയും (latency) ചിലവും കുറയ്ക്കുന്നതിനായി, OpenAI ഒരു cache-write ഫീ അവതരിപ്പിക്കുകയും cache reads-ന് 90% വൻ ഇളവ് നൽകുകയും ചെയ്തു. കൂടാതെ, സമാനമായ മോഡലുകളെ അപേക്ഷിച്ച് ഏജന്റിക് കോഡിംഗ് ടാസ്ക്കുകൾക്കായി 54% വരെ കുറഞ്ഞ ഔട്ട്പുട്ട് ടോക്കണുകൾ ഉപയോഗിക്കുന്നതിലൂടെ Sol ടോക്കൺ ഉപയോഗത്തിൽ വളരെ കാര്യക്ഷമമാണെന്ന് സിഇഒ സാം ആൾട്ട്മാൻ (Sam Altman) വ്യക്തമാക്കി.

ശക്തമാകുന്ന ആഗോള വിലയുദ്ധം

ഈ റിലീസ് AI ആയുധപ്പന്തയത്തിലെ (arms race) തന്ത്രപരമായ മാറ്റത്തെ സൂചിപ്പിക്കുന്നു. ചൈനീസ് ഓപ്പൺ സോഴ്സ് മോഡലുകളും, Meta-യുടെ Muse 1.1-ഉം, xAI-യുടെ Grok 4.5-ഉം ലാഭവിഹിതത്തിൽ (margins) സമ്മർദ്ദം ചെലുത്തുമ്പോൾ, OpenAI ഇപ്പോൾ വെറും ബുദ്ധിശക്തിയിൽ മാത്രമല്ല മത്സരിക്കുന്നത്—അത് യൂണിറ്റ് ഇക്കണോമിക്സിലും (unit economics) മത്സരിക്കുകയാണ്.

പ്രകടനം deയും വിലയിലും Anthropic-നെ സമ്മർദ്ദത്തിലാക്കിക്കൊണ്ട്, OpenAI വിപണിയിലുടനീളമുള്ള ഒരു പരിണാമത്തിന് വഴിയൊരുക്കുന്നു. വില കുറയ്ക്കുന്നതിനായുള്ള ഈ "race to the bottom" ഏജന്റിക് ആപ്ലിക്കേഷനുകൾ വികസിപ്പിക്കാൻ ആഗ്രഹിക്കുന്ന ഡെവലപ്പർമാർക്കും സ്ഥാപകർക്കും ഗുണകരമാണെങ്കിലും, ദീർഘകാലാടിസ്ഥാനത്തിൽ ഏത് AI ലാബുകൾ നിലനിൽക്കും എന്ന് നിർണ്ണയിക്കുന്ന കടുത്ത മത്സരസാഹചര്യം ഇത് സൃഷ്ടിക്കുന്നു.

പ്രധാന കാര്യങ്ങൾ

  • പ്രകടനത്തിലെ തുല്യത: Intelligence Index-ൽ Claude Fable 5-നോട് ഒരു പോയിന്റ് വ്യത്യാസത്തിൽ GPT-5.6 Sol എത്തുന്നു, കൂടാതെ Coding Agent Index-ൽ 80 പോയിന്റോടെ മുന്നേറുകയും ചെയ്യുന്നു.
  • സാമ്പത്തിക വിപ്ലവം: Fable 5-ന്റെ മൂന്നിലൊന്ന് ചിലവിൽ ($1.04 vs $2.75 per task) Sol മികച്ച ബുദ്ധിശക്തി പ്രദാനം ചെയ്യുന്നു.
  • ഏജന്റിക് കാര്യക്ഷമത: Cache reads-ന് 90% ഇളവും കോഡിംഗിനായി 54% കുറഞ്ഞ ഔട്ട്പുട്ട് ടോക്കണുകളും ഉൾപ്പെടെയുള്ള പുതിയ ഒപ്റ്റിമൈസേഷനുകൾ Sol-നെ സ്വയംഭരണ ഏജന്റുകൾക്കായി (autonomous agents) മികച്ചതാക്കുന്നു.