OpenAI GPT-5.6 Sol rzuca wyzwanie Fable 5 dzięki wyższej wydajności

OpenAI oficjalnie zrewolucjonizowało hierarchię modeli typu frontier poprzez wydanie GPT-5.6 Sol – flagowego modelu, który oferuje inteligencję niemal równą liderom za ułamek dotychczasowych kosztów. Optymalizując relację między wydajnością a ceną, OpenAI wyznacza nowy standard dla procesów agentycznych (agentic workflows) oraz wdrożeń na skalę korporacyjną.

Przełamywanie benchmarków: Dominacja w kodowaniu i równowaga inteligencji

Nowe dane z niezależnej platformy ewaluacyjnej Artificial Analysis pokazują, że GPT-5.6 Sol (max) depcze po piętach modelom najwyższej klasy od Anthropic. W rankingu Intelligence Index, Sol uzyskał 59 punktów, ustępując Claude Fable 5 zaledwie o jeden punkt. Stawia go to przed innymi gigantami, takimi jak Claude Opus 4.8 (56 punktów) i GPT-5.6 Terra (55 punktów).

Choć Fable 5 zachowuje niewielką przewagę w ogólnej inteligencji, OpenAI odniosło wyraźne zwycięstwo w dziedzinach specjalistycznych. W nowym Coding Agent Index, GPT-5.6 Sol zajął pierwsze miejsce z wynikiem 80 punktów w środowisku OpenAI Codex, wyprzedzając zarówno GPT-5.6 Terra (77 punktów), jak i Claude Fable 5 (77 punktów). Dodatkowo, w benchmarku AA-Briefcase – który mierzy wydajność w realistycznych zadaniach biurowych – Sol uzyskał najwyższy wynik „Presentation Elo” spośród wszystkich testowanych modeli.

Nowa granica Pareto: Radykalna redukcja kosztów

Najistotniejszym skutkiem wydania GPT-5.6 jest jego efektywność ekonomiczna. Artificial Analysis zauważa, że Sol „definiuje nową granicę Pareto w relacji Inteligencja vs Tokeny Wyjściowe na Zadanie”. Podczas gdy Claude Fable 5 kosztuje około 2,75 USD za zadanie, GPT-5.6 Sol osiąga porównywalny poziom za jedyne 1,04 USD – czyli około jednej trzeciej ceny.

OpenAI wprowadziło również wielopoziomowy ekosystem, aby sprostać różnym poziomom złożoności:

  • GPT-5.6 Sol: 5 USD za milion tokenów wejściowych / 30 USD za milion tokenów wyjściowych.
  • GPT-5.6 Terra: 2,50 USD za milion wejściowych / 15 USD za milion wyjściowych (o 50% taniej niż Sol).
  • GPT-5.6 Luna: 1 USD za milion wejściowych / 6 USD za milion wyjściowych (o 80% taniej niż Sol).

Aby jeszcze bardziej obniżyć opóźnienia i koszty powtarzalnych procesów, OpenAI wprowadziło opłatę za zapis do pamięci podręcznej (cache-write fee) oraz zaoferowało ogromną, 90-procentową zniżkę na odczyty z pamięci podręcznej (cache reads). Co więcej, CEO Sam Altman zauważył, że Sol jest znacznie bardziej wydajny pod względem zużycia tokenów, wykorzystując do 54% mniej tokenów wyjściowych w zadaniach agentycznego kodowania w porównaniu do podobnych modeli.

Intensyfikująca się globalna wojna cenowa

To wydanie sygnalizuje strategiczną zmianę w wyścigu zbrojeń AI. W obliczu presji spadkowej na marże wywieranej przez chińskie modele open-source, Muse 1.1 od Meta oraz Grok 4.5 od xAI, OpenAI nie konkuruje już tylko czystą inteligencją – konkuruje ekonomią jednostkową.

Dociskając Anthropic zarówno pod względem wydajności, jak i ceny, OpenAI wymusza ewolucję całego rynku. Choć ten „wyścig do dna” w kwestii cenowania przynosi korzyści programistom i założycielom dążącym do skalowania aplikacji agentycznych, tworzy on intensywne środowisko konkurencyjne, które zadecyduje o tym, które laboratoria AI pozostaną rentowne w dłuższej perspektywie.

Kluczowe wnioski

  • Równowaga wydajności: GPT-5.6 Sol dorównuje Claude Fable 5 w ramach jednego punktu w Intelligence Index i dominuje w Coding Agent Index z wynikiem 80 punktów.
  • Przełom ekonomiczny: Sol oferuje inteligencję bliską modelom typu frontier za jedną trzecią kosztów Fable 5 (1,04 USD vs 2,75 USD za zadanie).
  • Wydajność agentyczna: Nowe optymalizacje, w tym 90-procentowa zniżka na odczyty z pamięci podręcznej oraz o 54% mniej tokenów wyjściowych przy kodowaniu, sprawiają, że Sol jest wysoce zoptymalizowany pod kątem autonomicznych agentów.