Anthropic onthult Claude Opus 5: Elite prestaties tegen de helft van de kosten

Anthropic heeft officieel Claude Opus 5 gelanceerd, een nieuw vlaggenschipmodel dat ontworpen is om de high-end LLM-markt te ontwrichten door bijna gelijkwaardige prestaties te bieden aan het premium Claude Fable 5, maar tegen een aanzienlijk lagere prijs. Deze strategische zet heeft als doel de prijsdruk van concurrenten zoals GPT-5.6 Sol te neutraliseren, terwijl ontwikkelaars een efficiëntere tool krijgen voor coderen en complex kennisswerk.

De prijs-prestatiegrens doorbreken

Het meest opvallende kenmerk van Claude Opus 5 is de agressieve prijsstructuur. Waar het topmodel Claude Fable 5 $10 per miljoen inputtokens en $50 per miljoen outputtokens kost, halveert Opus 5 deze tarieven naar $5 per miljoen input- en $25 per miljoen outputtokens.

Om te voldoen aan de eisen voor latentie heeft Anthropic ook een "Fast Mode" geïntroduceerd, die de verwerkingssnelheid met 2,5x verhoogt, hoewel dit gepaard gaat met een verdubbeling van de kosten per token. Deze gelaagde prijsstelling, gecombineerd met een enorme context window van 1 miljoen tokens, positioneert Opus 5 als het nieuwe standaardmodel voor Claude Max en de meest capabele optie voor Claude Pro-gebruikers.

Superieur in benchmarks voor coderen en redeneren

Opus 5 is niet louter een budgetalternatief; het is een krachtpatser qua prestaties in specifieke domeinen. Bij agentic terminal coding via de Frontier-Bench v0.1 behaalde Opus 5 een score van 43,3%, waarmee het zowel Fable 5 (33,7%) als GPT-5.6 Sol (34,4%) ruim verslaat. Het toonde ook dominantie in kennisswerk door de GDPval-AA v2 benchmark te leiden met een Elo-score van 1.861.

Misschien wel de meest verbazingwekkende statistiek komt uit de ARC-AGI-3 benchmark, die het oplossen van nieuwe problemen meet. Opus 5 scoorde 30,2%, wat bijna vier keer zo hoog is als de 7,8% van GPT-5.6 Sol. Dit wijst op een enorme sprong in het vermogen van het model om taken aan te pakken die buiten de patronen van de trainingsdata vallen.

Intelligente schaling van inspanning en efficiëntie

Anthropic heeft een geavanceerd "effort"-systeem geïntroduceerd, waarmee gebruikers kunnen schakelen tussen vijf instellingen: low, medium, high, xhigh en max. Dit maakt een nauwkeurige afweging mogelijk tussen tokenverbruik en de diepgang van het redeneervermogen.

Hoewel Anthropic "low" en "medium" instellingen aanbeveelt voor algemene taken om de kosten te optimaliseren, adviseren ze "xhigh" te gebruiken voor complexe agentic coding. Interessant genoeg merkte het bedrijf op dat er sprake is van een afnemend rendement bij de "max"-instelling; zowel op de Frontier-Bench v0.1 als op de Artificial Analysis Coding Agent Index zag Opus 5 bij maximale inspanning een lichte daling in prestaties ondanks de hogere kosten. Dit suggereert dat de "xhigh"-instelling momenteel de sweet spot is voor efficiëntie.

Verbeterde veiligheid en autonomie

Als directe reactie op feedback van gebruikers heeft Anthropic de veiligheidsclassificaties voor Opus 5 verfijnd. De cyberfilters van het model worden ongeveer 85% minder vaak geactiveerd dan die van Fable 5, wat ingaat op eerdere kritiek over het overdreven blokkeren van legitiem onderzoek. Hoewel het nog steeds het genereren van exploits en binary-gebaseerde scanning voorkomt, is het veel toleranter voor onderzoek naar kwetsbaarheden in broncode.

Bovendien vertoont Opus 5 verbeterde zelfcorrigerende vermogens. In praktijktests slaagde het model erin om een 3D-model in FreeCAD te bouwen door zijn eigen computer vision-pipeline te schrijven om geometrie te interpreteren — een taak waar alle andere concurrerende modellen op vastliepen.

Belangrijkste punten

  • Drastische kostenverlaging: Opus 5 biedt prestaties op vlaggenschipniveau tegen 50% van de kosten per token van Claude Fable 5.
  • Doorbraak in redeneervermogen: Het model liet een enorme voorsprong van 4x zien op concurrenten in de ARC-AGI-3 benchmark voor het oplossen van nieuwe problemen.
  • Geoptimaliseerde workflow voor ontwikkelaars: Met verbeterde veiligheidsclassificaties en gespecialiseerde "effort"-instellingen biedt Opus 5 een vloeiendere ervaring voor agentic coding en onderzoek.