Anthropic prezentuje Claude Opus 5: Elitarna wydajność za połowę ceny
Anthropic oficjalnie wprowadziło Claude Opus 5, nowy flagowy model zaprojektowany, aby zrewolucjonizować rynek wysokiej klasy modeli LLM, oferując niemal taką samą wydajność jak premium Claude Fable 5 przy znacznie niższej cenie. Ten strategiczny ruch ma na celu zneutralizowanie presji cenowej ze strony konkurentów, takich jak GPT-5.6 Sol, przy jednoczesnym zapewnieniu programistom bardziej wydajnego narzędzia do kodowania i złożonej pracy intelektualnej.
Przełamywanie granic stosunku ceny do wydajności
Najbardziej uderzającą cechą Claude Opus 5 jest agresywna struktura cenowa. Podczas gdy najwyższej klasy Claude Fable 5 kosztuje 10 USD za milion tokenów wejściowych i 50 USD za milion tokenów wyjściowych, Opus 5 obniża te stawki o połowę, oferując cenę 5 USD za milion tokenów wejściowych i 25 USD za milion tokenów wyjściowych.
Aby sprostać wymaganiom dotyczącym opóźnień, Anthropic wprowadziło również „Fast Mode”, który zwiększa prędkość przetwarzania 2,5-krotnie, choć odbywa się to kosztem dwukrotnego zwiększenia ceny tokenów. Ta wielopoziomowa wycena, w połączeniu z ogromnym oknem kontekstowym wynoszącym 1 milion tokenów, pozycjonuje Opus 5 jako nowy model domyślny dla Claude Max oraz najbardziej zaawansowaną opcję dla użytkowników Claude Pro.
Dominacja w benchmarkach kodowania i rozumowania
Opus 5 to nie tylko budżetowa alternatywa; to potężne narzędzie pod względem wydajności w konkretnych dziedzinach. W zadaniach agentycznego kodowania w terminalu (agentic terminal coding) według Frontier-Bench v0.1, Opus 5 osiągnął wynik 43,3%, znacząco przewyższając zarówno Fable 5 (33,7%), jak i GPT-5.6 Sol (34,4%). Model wykazał również dominację w pracy intelektualnej, prowadząc ranking w benchmarku GDPval-AA v2 z wynikiem Elo wynoszącym 1861.
Być może najbardziej zdumiewająca statystyka pochodzi z benchmarku ARC-AGI-3, który mierzy zdolność do rozwiązywania nowych problemów. Opus 5 uzyskał wynik 30,2%, niemal czterokrotnie przewyższając 7,8% osiągnięte przez GPT-5.6 Sol. Sugeruje to ogromny skok w zdolności modelu do radzenia sobie z zadaniami wykraczającymi poza wzorce danych treningowych.
Inteligentne skalowanie wysiłku i wydajność
Anthropic wprowadziło wyrafinowany system „effort” (wysiłku), pozwalający użytkownikom przełączać się między pięcioma ustawieniami: low, medium, high, xhigh oraz max. Umożliwia to precyzyjne balansowanie między zużyciem tokenów a głębią rozumowania.
Choć Anthropic zaleca ustawienia „low” i „medium” do ogólnych zadań w celu optymalizacji kosztów, doradza używanie „xhigh” przy złożonym kodowaniu agentycznym. Co ciekawe, firma odnotowała malejące korzyści przy ustawieniu „max”; zarówno w Frontier-Bench v0.1, jak i w Artificial Analysis Coding Agent Index, Opus 5 wykazał niewielki spadek wydajności przy maksymalnym wysiłku mimo wyższego kosztu, co sugeruje, że ustawienie „xhigh” może być obecnie optymalnym punktem (sweet spot) pod względem wydajności.
Poprawione bezpieczeństwo i autonomia
W bezpośredniej odpowiedzi na opinie użytkowników, Anthropic dostroiło klasyfikatory bezpieczeństwa dla Opus 5. Filtry cybernetyczne modelu aktywują się o około 85% rzadziej niż w przypadku Fable 5, co adresuje wcześniejsze krytyki dotyczące nadgorliwego blokowania zasadnych badań. Choć model nadal zapobiega generowaniu exploitów i skanowaniu opartemu na plikach binarnych, jest znacznie bardziej tolerancyjny w przypadku badań podatności kodu źródłowego.
Co więcej, Opus 5 wykazuje ulepszone zdolności do autokorekty. W testach w rzeczywistych warunkach model z powodzeniem zbudował model 3D w FreeCAD, pisząc własny potok przetwarzania obrazu (computer vision pipeline) do interpretacji geometrii – zadanie, które sprawiło trudność wszystkim innym konkurencyjnym modelom.
Kluczowe wnioski
- Drastyczna redukcja kosztów: Opus 5 oferuje wydajność na poziomie flagowym przy 50% kosztów tokenów modelu Claude Fable 5.
- Przełom w rozumowaniu: Model wykazał ogromną, 4-krotną przewagę nad konkurencją w benchmarku ARC-AGI-3 w zakresie rozwiązywania nowych problemów.
- Zoptymalizowany przepływ pracy programisty: Dzięki ulepszonym klasyfikatorom bezpieczeństwa i specjalistycznym ustawieniom „effort”, Opus 5 zapewnia bardziej płynne doświadczenie w kodowaniu agentycznym i badaniach.
