Claude Opus 5 trafił na rynek 24 lipca, a jego główne wyniki obiecują trzykrotny skok w porównaniu z najbliższym rywalem i dwukrotnie wyższą wydajność niż własny Opus 4.8 od Anthropic. Prawdziwym pytaniem dla każdego, kto płaci za wyniki generowane przez AI, jest to, czy te proporcje przełożą się na wymierne korzyści bez podnoszenia ceny.
Dlaczego te liczby mają znaczenie
Deweloperom najbardziej zależy na wyniku SWE-bench Pro – benchmarku, który sprawdza model na rzeczywistych problemach z GitHub, aby zobaczyć, jak dobrze radzi sobie z naprawianiem kodu. Opus 5 osiągnął 79,2%, podczas gdy Opus 4.8 uzyskał 69,2% – to wzrost o dziesięć punktów procentowych w zaledwie dwa miesiące. Anthropic utrzymał cenę za token na niezmienionym poziomie, więc użytkownicy otrzymują znacznie inteligentniejszego as
