Anthropic heeft op 24 juli Claude Opus 5 uitgerold, waarbij het contextvenster is uitgebreid naar één miljoen tokens tegen dezelfde prijs als Opus 4.8. Ontwikkelaars die geautomatiseerde workflows bouwen, zouden dit moeten weten: de update voegt controles voor het inspanningsniveau toe, een verplichte "thinking"-fase, prompt caching voor korte prompts en de mogelijkheid om tijdens een gesprek van tools te wisselen — functies die integratiepatronen en kostenstructuren kunnen hervormen.
Waarom de upgrade belangrijk is
Opus 5 claimt een intelligentie die vergelijkbaar is met de "Fable 5"-benchmark tegen de helft van de kosten. In de praktijk verwerkt het model inputs tot een miljoen tokens en genereert het tot 128k tokens zonder de tarieven te verhogen.
Nieuwe instellingen voor ontwikkelaars
Controles voor het inspanningsniveau
Het model staat standaard op een "high" inspanningsniveau, maar biedt vijf niveaus: low, medium, high, xhigh en max. Elk niveau wisselt rekentijd en kosten uit voor de kwaliteit van het antwoord. Ontwikkelaars kunnen een taak starten met een hoog inspanningsniveau, zakken naar een lager niveau als de taak eenvoudig blijkt te zijn, of opschalen naar xhigh/max wanneer het probleem complex is.
Verplichte "thinking"-modus
Claude doorloopt nu een "thinking"-fase voordat er output wordt gegenereerd. Deze fase is verplicht voor de twee hoogste inspanningsniveaus (xhigh, max) en kan niet worden uitgeschakeld.
Prompt caching voor prompts van 512 tokens
Prompt caching werkt nu ook voor prompts van slechts 512 tokens.
Wisselen van tools tijdens een gesprek (bèta)
Een bètafunctie stelt een lopende Claude-sessie in staat om de externe tool die wordt aangeroepen te wijzigen — bijvoorbeeld het vervangen van een webzoekmodule door een databasequery — zonder het gesprek opnieuw te hoeven starten.
Gevolgen voor integratieworkflows
De toegevoegde controles geven engineers meer granulariteit over kosten en prestaties, maar introduceren ook nieuwe foutmodi. Verplichte "thinking" bij xhigh/max betekent dat bestaande code die intern redeneren uitschakelt, nu foutmeldingen zal geven. Het wisselen van tools tijdens een gesprek is nog in bèta, dus stabiliteit is niet gegarandeerd.
Tegenargument
Anthropic heeft de prijzen gelijk gehouden, maar de hogere inspanningsniveaus verbruiken meer rekenkracht.
Waar u op moet letten
- Updates voor de "fast mode"-preview, die lagere latentie belooft voor onderzoekstaken, maar nog niet algemeen beschikbaar is.
Voor ontwikkelaars waarvan de pipelines Claude onbeheerd draaien, biedt Opus 5 een gereedschapskist waarmee ze meer intelligentie uit elke dollar kunnen halen — mits ze hun code aanpassen om rekening te houden met de "thinking"-fasen en de nieuwe caching- en tool-switching-paden testen.
