OpenAI GPT-5.6 Sol ਨੇ ਉੱਤਮ ਕੁਸ਼ਲਤਾ ਨਾਲ Fable 5 ਨੂੰ ਚੁਣੌਤੀ ਦਿੱਤੀ

OpenAI ਨੇ GPT-5.6 Sol ਦੀ ਰਿਲੀਜ਼ ਨਾਲ ਅਧਿਕਾਰਤ ਤੌਰ 'ਤੇ ਫਰੰਟੀਅਰ ਮਾਡਲ ਹਾਇਰਾਰਕੀ (hierarchy) ਨੂੰ ਹਿਲਾ ਕੇ ਰੱਖ ਦਿੱਤਾ ਹੈ, ਜੋ ਕਿ ਇੱਕ ਅਜਿਹਾ ਫਲੈਗਸ਼ਿਪ ਮਾਡਲ ਹੈ ਜੋ ਬਹੁਤ ਹੀ ਘੱਟ ਲਾਗਤ 'ਤੇ ਲਗਭਗ ਬਰਾਬਰ ਦੀ ਬੁੱਧੀ (intelligence) ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਪ੍ਰਦਰਸ਼ਨ ਅਤੇ ਕੀਮਤ ਦੇ ਵਿਚਕਾਰ ਸਬੰਧ ਨੂੰ ਸੁਧਾਰ ਕੇ, OpenAI ਏਜੈਂਟਿਕ ਵਰਕਫਲੋਜ਼ (agentic workflows) ਅਤੇ ਐਂਟਰਪ੍ਰਾਈਜ਼-ਪੱਧਰ ਦੀ ਤੈਨਾਤੀ ਲਈ ਇੱਕ ਨਵਾਂ ਮਿਆਰ ਸਥਾਪਤ ਕਰ ਰਿਹਾ ਹੈ।

ਬੈਂਚਮਾਰਕ ਤੋੜਨਾ: ਕੋਡਿੰਗ 'ਤੇ ਦਬਦਬਾ ਅਤੇ ਬੁੱਧੀ ਦੀ ਬਰਾਬਰੀ

ਸੁਤੰਤਰ ਮੁਲਾਂਕਣ ਪਲੇਟਫਾਰਮ Artificial Analysis ਤੋਂ ਮਿਲੇ ਨਵੇਂ ਅੰਕੜੇ ਦੱਸਦੇ ਹਨ ਕਿ GPT-5.6 Sol (max) Anthropic ਦੇ ਉੱਚ-ਦਰਜੇ ਦੇ ਮਾਡਲਾਂ ਦੇ ਬਹੁਤ ਨੇੜੇ ਪਹੁੰਚ ਗਿਆ ਹੈ। Intelligence Index 'ਤੇ, Sol ਨੇ 59 ਅੰਕ ਪ੍ਰਾਪਤ ਕੀਤੇ, ਜੋ Claude Fable 5 ਤੋਂ ਸਿਰਫ਼ ਇੱਕ ਅੰਕ ਪਿੱਛੇ ਹਨ। ਇਹ ਇਸਨੂੰ Claude Opus 4.8 (56 ਅੰਕ) ਅਤੇ GPT-5.6 Terra (55 ਅੰਕ) ਵਰਗੇ ਹੋਰ ਭਾਰੀ ਮਾਡਲਾਂ ਤੋਂ ਅੱਗੇ ਰੱਖਦਾ ਹੈ।

ਹਾਲਾਂਕਿ Fable 5 ਸਮੁੱਚੀ ਆਮ ਬੁੱਧੀ ਵਿੱਚ ਥੋੜ੍ਹਾ ਜਿਹਾ ਅੱਗੇ ਹੈ, ਪਰ OpenAI ਨੇ ਵਿਸ਼ੇਸ਼ ਖੇਤਰਾਂ ਵਿੱਚ ਸਪੱਸ਼ਟ ਜਿੱਤ ਹਾਸਲ ਕੀਤੀ ਹੈ। ਨਵੇਂ Coding Agent Index ਵਿੱਚ, OpenAI ਦੇ Codex ਵਾਤਾਵਰਣ ਵਿੱਚ ਚੱਲਣ ਵੇਲੇ GPT-5.6 Sol ਨੇ 80 ਅੰਕਾਂ ਨਾਲ ਸਿਖਰਲਾ ਸਥਾਨ ਹਾਸਲ ਕੀਤਾ, ਜੋ ਕਿ GPT-5.6 Terra (77 ਅੰਕ) ਅਤੇ Claude Fable 5 (77 ਅੰਕ) ਦੋਵਾਂ ਤੋਂ ਬਿਹਤਰ ਹੈ। ਇਸ ਤੋਂ ਇਲਾਵਾ, AA-Briefcase ਬੈਂਚਮਾਰਕ ਵਿੱਚ—ਜੋ ਕਿ ਅਸਲ ਦਫ਼ਤਰੀ ਕੰਮਾਂ 'ਤੇ ਪ੍ਰਦਰਸ਼ਨ ਨੂੰ ਮਾਪਦਾ ਹੈ—Sol ਨੇ ਸਾਰੇ ਟੈਸਟ ਕੀਤੇ ਮਾਡਲਾਂ ਵਿੱਚ ਸਭ ਤੋਂ ਉੱਚਾ "Presentation Elo" ਪ੍ਰਾਪਤ ਕੀਤਾ।

ਨਵਾਂ Pareto Frontier: ਲਾਗਤ ਵਿੱਚ ਭਾਰੀ ਕਟੌਤੀ

GPT-5.6 ਦੀ ਰਿਲੀਜ਼ ਦਾ ਸਭ ਤੋਂ ਮਹੱਤਵਪੂਰਨ ਪ੍ਰਭਾਵ ਇਸਦੀ ਆਰਥਿਕ ਕੁਸ਼ਲਤਾ ਵਿੱਚ ਹੈ। Artificial Analysis ਨੋਟ ਕਰਦਾ ਹੈ ਕਿ Sol "Intelligence vs Output Tokens per Task ਦਾ ਇੱਕ ਨਵਾਂ Pareto frontier ਨਿਰਧਾਰਤ ਕਰਦਾ ਹੈ।" ਜਿੱਥੇ Claude Fable 5 ਦੀ ਲਾਗਤ ਪ੍ਰਤੀ ਟਾਸਕ ਲਗਭਗ $2.75 ਹੈ, ਉੱਥੇ GPT-5.6 Sol ਸਿਰਫ਼ $1.04 ਵਿੱਚ ਤੁਲਨਾਯੋਗ ਪੱਧਰ 'ਤੇ ਕੰਮ ਕਰਦਾ ਹੈ—ਜੋ ਕਿ ਲਗਭਗ ਇੱਕ ਤਿਹਾਈ ਕੀਮਤ ਹੈ।

OpenAI ਨੇ ਵੱਖ-ਵੱਖ ਪੱਧਰਾਂ ਦੀ ਗੁੰਝਲਤਾ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਇੱਕ ਤਰਤੀਬਵਾਰ (tiered) ਈਕੋਸਿਸਟਮ ਵੀ ਪੇਸ਼ ਕੀਤਾ ਹੈ:

  • GPT-5.6 Sol: $5 ਪ੍ਰਤੀ ਮਿਲੀਅਨ input tokens / $30 ਪ੍ਰਤੀ ਮਿਲੀਅਨ output tokens.
  • GPT-5.6 Terra: $2.50 ਪ੍ਰਤੀ ਮਿਲੀਅਨ input / $15 ਪ੍ਰਤੀ ਮਿਲੀਅਨ output (Sol ਨਾਲੋਂ 50% ਸਸਤਾ)।
  • GPT-5.6 Luna: $1 ਪ੍ਰਤੀ ਮਿਲੀਅਨ input / $6 ਪ੍ਰਤੀ ਮਿਲੀਅਨ output (Sol ਨਾਲੋਂ 80% ਸਸਤਾ)।

ਵਾਰ-ਵਾਰ ਹੋਣ ਵਾਲੇ ਵਰਕਫਲੋਜ਼ ਲਈ ਲੇਟੈਂਸੀ (latency) ਅਤੇ ਲਾਗਤ ਨੂੰ ਹੋਰ ਘਟਾਉਣ ਲਈ, OpenAI ਨੇ cache-write ਫੀਸ ਪੇਸ਼ ਕੀਤੀ ਹੈ ਅਤੇ cache reads 'ਤੇ ਭਾਰੀ 90% ਦੀ ਛੋਟ ਦਿੱਤੀ ਹੈ। ਇਸ ਤੋਂ ਇਲਾਵਾ, CEO Sam Altman ਨੇ ਨੋਟ ਕੀਤਾ ਕਿ Sol ਟੋਕਨ ਦੀ ਖਪਤ ਵਿੱਚ ਕਾਫ਼ੀ ਵਧੇਰੇ ਕੁਸ਼ਲ ਹੈ, ਜੋ ਕਿ ਸਮਾਨ ਮਾਡਲਾਂ ਦੇ ਮੁਕਾਬਲੇ ਏਜੈਂਟਿਕ ਕੋਡਿੰਗ ਕੰਮਾਂ ਲਈ 54% ਤੱਕ ਘੱਟ output tokens ਦੀ ਵਰਤੋਂ ਕਰਦਾ ਹੈ।

ਤੇਜ਼ ਹੁੰਦੀ ਵਿਸ਼ਵਵਿਆਪੀ ਕੀਮਤ ਦੀ ਜੰਗ

ਇਹ ਰਿਲੀਜ਼ AI ਹਥਿਆਰਾਂ ਦੀ ਦੌੜ ਵਿੱਚ ਇੱਕ ਰਣਨੀਤਕ ਤਬਦੀਲੀ ਦਾ ਸੰਕੇਤ ਦਿੰਦੀ ਹੈ। ਜਿਵੇਂ ਕਿ ਚੀਨੀ ਓਪਨ-ਸੋਰਸ ਮਾਡਲ, Meta ਦਾ Muse 1.1, ਅਤੇ xAI ਦਾ Grok 4.5 ਮਾਰਜਿਨਾਂ 'ਤੇ ਦਬਾਅ ਪਾ ਰਹੇ ਹਨ, OpenAI ਹੁਣ ਸਿਰਫ਼ ਸ਼ੁੱਧ ਬੁੱਧੀ (raw intelligence) 'ਤੇ ਮੁਕਾਬਲਾ ਨਹੀਂ ਕਰ ਰਿਹਾ—ਇਹ ਯੂਨਿਟ ਇਕਨਾਮਿਕਸ (unit economics) 'ਤੇ ਮੁਕਾਬਲਾ ਕਰ ਰਿਹਾ ਹੈ।

ਪ੍ਰਦਰਸ਼ਨ ਅਤੇ ਕੀਮਤ ਦੋਵਾਂ 'ਤੇ Anthropic ਨੂੰ ਦਬਾਅ ਵਿੱਚ ਲਿਆ ਕੇ, OpenAI ਪੂਰੇ ਬਾਜ਼ਾਰ ਵਿੱਚ ਵਿਕਾਸ ਲਈ ਮਜਬੂਰ ਕਰ ਰਿਹਾ ਹੈ। ਹਾਲਾਂਕਿ ਕੀਮਤਾਂ ਵਿੱਚ ਇਹ "race to the bottom" ਏਜੈਂਟਿਕ ਐਪਲੀਕੇਸ਼ਨਾਂ ਨੂੰ ਵਧਾਉਣ ਦੇ ਚਾਹਵਾਨ ਡਿਵੈਲਪਰਾਂ ਅਤੇ ਸੰਸਥਾਪਕਾਂ ਨੂੰ ਲਾਭ ਪਹੁੰਚਾਉਂਦੀ ਹੈ, ਪਰ ਇਹ ਇੱਕ ਤਿੱਖਾ ਮੁਕਾਬਲੇਬਾਜ਼ੀ ਵਾਲਾ ਮਾਹੌਲ ਬਣਾਉਂਦੀ ਹੈ ਜੋ ਇਹ ਤੈਅ ਕਰੇਗਾ ਕਿ ਕਿਹੜੀਆਂ AI ਲੈਬਾਂ ਲੰਬੇ ਸਮੇਂ ਤੱਕ ਟਿਕ ਸਕਦੀਆਂ ਹਨ।

ਮੁੱਖ ਗੱਲਾਂ (Key Takeaways)

  • ਪ੍ਰਦਰਸ਼ਨ ਦੀ ਬਰਾਬਰੀ: GPT-5.6 Sol Intelligence Index 'ਤੇ Claude Fable 5 ਦੇ ਇੱਕ ਅੰਕ ਦੇ ਅੰਦਰ ਮਿਲਦਾ ਹੈ ਅਤੇ 80 ਅੰਕਾਂ ਨਾਲ Coding Agent Index 'ਤੇ ਦਬਦਬਾ ਬਣਾਉਂਦਾ ਹੈ।
  • ਆਰਥਿਕ ਵਿਘਨ: Sol, Fable 5 ਦੀ ਲਾਗਤ ਦੇ ਇੱਕ ਤਿਹਾਈ 'ਤੇ (ਪ੍ਰਤੀ ਟਾਸਕ $1.04 ਬਨਾਮ $2.75) ਲਗਭਗ ਫਰੰਟੀਅਰ ਬੁੱਧੀ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ।
  • ਏਜੈਂਟਿਕ ਕੁਸ਼ਲਤਾ: ਨਵੇਂ ਅਪਟੀਮਾਈਜ਼ੇਸ਼ਨ, ਜਿਸ ਵਿੱਚ cache reads 'ਤੇ 90% ਦੀ ਛੋਟ ਅਤੇ ਕੋਡਿੰਗ ਲਈ 54% ਘੱਟ output tokens ਸ਼ਾਮਲ ਹਨ, Sol ਨੂੰ ਖੁਦਮੁਖਤਿਆਰ ਏਜੰਟਾਂ (autonomous agents) ਲਈ ਬਹੁਤ ਜ਼ਿਆਦਾ ਅਪਟੀਮਾਈਜ਼ਡ ਬਣਾਉਂਦੇ ਹਨ।