Anthropic ha rilasciato Claude Opus 5 il 24 luglio, espandendo la finestra di contesto a un milione di token e mantenendo il prezzo di Opus 4.8. Gli sviluppatori che costruiscono workflow automatizzati dovrebbero prestare attenzione: l'aggiornamento aggiunge controlli del livello di sforzo (effort-level), una fase di “thinking” obbligatoria, il prompt caching per i prompt brevi e la possibilità di scambiare gli strumenti a metà conversazione — funzionalità che potrebbero rimodellare i pattern di integrazione e le strutture dei costi.
Perché l'aggiornamento è importante
Opus 5 dichiara un'intelligenza paragonabile al benchmark “Fable 5” alla metà del costo. In pratica, il modello gestisce input fino a un milione di token e genera fino a 128k token senza aumentare le tariffe.
Nuove leve orientate agli sviluppatori
Controlli del livello di sforzo
Il modello utilizza di default un'impostazione di sforzo “high”, ma offre cinque livelli: low, medium, high, xhigh e max. Ogni livello scambia tempo di calcolo e costi con la qualità della risposta. Gli sviluppatori possono avviare un lavoro con uno sforzo elevato (high), passare a un livello inferiore se il compito si rivela semplice, o salire a xhigh/max quando il problema è complesso.
Modalità di pensiero obbligatoria
Claude ora esegue una fase di “thinking” prima di emettere qualsiasi output. La fase è obbligatoria per i due livelli di sforzo più elevati (xhigh, max) e non può essere disattivata.
Prompt caching per prompt da 512 token
Il prompt caching ora funziona anche su prompt piccoli come 512 token.
Cambio degli strumenti a metà conversazione (beta)
Una funzionalità beta consente a una sessione Claude in corso di cambiare lo strumento esterno che richiama — ad esempio, sostituendo un modulo di ricerca web con una query al database — senza dover riavviare la conversazione.
Implicazioni per i workflow di integrazione
I controlli aggiunti offrono agli ingegneri una granularità più fine su costi e prestazioni, ma introducono anche nuovi modi di guasto. Il “thinking” obbligatorio a xhigh/max significa che qualsiasi codice esistente che disabilita il ragionamento interno ora incontrerà errori. Il cambio degli strumenti a metà conversazione è ancora in beta, quindi la stabilità non è garantita.
Controargomentazione
Anthropic ha mantenuto i prezzi invariati, ma i livelli di sforzo più elevati consumano più risorse di calcolo.
Cosa osservare in seguito
- Aggiornamenti alla anteprima della “fast mode”, che promette una latenza inferiore per i carichi di lavoro di ricerca, ma non è ancora disponibile per tutti.
Per gli sviluppatori i cui pipeline eseguono Claude in modo non supervisionato, Opus 5 offre una cassetta degli attrezzi che può estrarre più intelligenza da ogni dollaro — a patto che adattino il proprio codice per accogliere le fasi di thinking e testino i nuovi percorsi di caching e di cambio degli strumenti.
