Anthropic ha lanciato ufficialmente i suoi molto attesi modelli Claude Fable 5.1 e Mythos 5.1, rivolti alla crescente domanda di agenti AI efficienti e ad alte prestazioni. Questo aggiornamento si concentra sulla riduzione dei costi operativi, sul perfezionamento delle barriere di sicurezza e sul potenziamento delle capacità di ragionamento per workflow complessi e multi-step.
Riduzioni drastiche dei costi per i workflow agentici
Uno dei cambiamenti più significativi di questo rilascio è la nuova e aggressiva struttura di prezzi progettata per i compiti "agentici" — workflow in cui un'IA deve eseguire molteplici passaggi iterativi per raggiungere un obiettivo. Anthropic afferma che Claude Fable 5.1 è tipicamente il 25% più economico del suo predecessore, Fable 5, ma può offrire risparmi fino al 45% per operazioni agentiche complesse.
Questa massiccia riduzione è ottenuta attraverso una tariffazione ottimizzata sui dati in cache. Abbassando il costo per i dati che sono già stati elaborati e memorizzati, Anthropic rende economicamente vantaggioso per gli sviluppatori la creazione di agenti IA a lunga durata e ad alta intensità di memoria che si affidano al recupero ripetuto del contesto.
Capacità di coding e ragionamento superiori
I primi utilizzatori del settore stanno già segnalando salti significativi nelle prestazioni. Dan Shipper, CEO di Every, ha definito Fable 5.1 come il modello di coding più forte attualmente disponibile, sottolineando che il modello non è solo più veloce e più efficiente in termini di token, ma possiede anche un tono conversazionale più naturale e simile a quello umano.
I miglioramenti si estendono oltre la semplice generazione di testo fino a una sfumata interpretazione dei dati. Il CEO di Box, Aaron Levie, ha notato che gli agenti della sua azienda che utilizzano Fable 5.1 sono stati in grado di rilevare sottigliezze e ambiguità nei set di dati che il precedente modello Fable 5 aveva completamente ignorato. Inoltre, il modello Mythos 5.1 ha mostrato una straordinaria efficienza; i dati dei benchmark suggeriscono che Mythos 5.1 in modalità "low reasoning" si comporta allo stesso livello delle impostazioni "Max reasoning" della generazione precedente, rappresentando un enorme salto nell'efficienza architettonica.
Protezioni perfezionate e privacy aziendale
Anthropic sta affrontando anche le critiche di lunga data riguardanti i filtri di sicurezza "eccessivamente zelanti". Fable 5.1 presenta protezioni più precise, rendendo meno probabile l'attivazione di falsi positivi su query innocue, come domande di biologia di base. Mentre Mythos 5.1 mantiene restrizioni biologiche più rigorose, l'obiettivo complessivo è un'esperienza utente più orientata all'utilità.
In una grande vittoria per la sicurezza aziendale, Anthropic ha annunciato i suoi "Enterprise Frontier Safeguards". In fase di rilascio in autunno, questa funzione permetterà una "privacy completa" consentendo ai clienti di memorizzare i dati sui propri server cloud anziché sull'infrastruttura di Anthropic. Inoltre, sebbene a Fable 5.1 sia ora consentito identificare vulnerabilità software, Anthropic mantiene un confine rigoroso reindirizzando i compiti ad alto rischio — come la generazione di exploit e i penetration test — ai suoi modelli Opus più potenti.
Punti chiave
- Efficienza economica: Claude Fable 5.1 offre costi inferiori fino al 45% per i compiti agentici grazie a una tariffazione ottimizzata dei dati in cache.
- Guadagni di prestazioni: I primi feedback evidenziano capacità di coding superiori, una migliore gestione dell'ambiguità dei dati e un'efficienza di ragionamento migliorata.
- Privacy potenziata: I nuovi Enterprise Frontier Safeguards consentiranno alle aziende di memorizzare i dati sui propri server cloud per garantire una privacy totale.
