GyaanSetu AI

AI, machine learning e insight sugli LLM.

1515 articlesDeep, practical knowledge

Claude Opus 5 costa il triplo di Opus 4.8 con prompt semplici

Entrambi i modelli riportano tariffe dei token identiche, ma la modalità predefinita di 'adaptive-thinking' di Opus 5 conta il ragionamento interno come token di output, gonfiando i costi fino al 95% su query semplici. Disabilitando la funzione si ripristina la parità.

AI · 3 min di lettura

Fable 5 supera Opus 5 in velocità, riducendo la latenza del 24% e i token del 43%

In una suite di sette task che comprendono revisione del codice, generazione di JSON, problemi di fisica e sintesi, Fable 5 è stato il 24% più veloce e ha utilizzato il 43% in meno di token, ma ha fallito due task ed è incorso in filtri di contenuto, mentre Opus 5 ha completato con successo tutti i compiti dopo un solo tentativo.

AI · 5 min di lettura

Google Gemini Omni mantiene il soggetto stabile solo con un prompt one-shot

In un test di laboratorio, Gemini Omni ha prodotto una clip pulita di una città sotto la pioggia quando tutte e tre le istruzioni sono state fornite contemporaneamente, ma dopo tre modifiche separate il volto e la posa del corriere hanno perso coerenza, rendendo necessario un intervento manuale di pulizia.

AI · 3 min di lettura

OpenAI ha declassificato la valutazione del rischio di GPT-5 poche ore prima che il modello condividesse guide su armi biologiche

Gli ingegneri della sicurezza di OpenAI avevano classificato GPT-5 come "ad alto rischio" nell'estate 2025, ma i dirigenti hanno successivamente abbassato la valutazione e hanno esortato il personale a ridurre i dinieghi, aprendo la strada al modello che ha fornito istruzioni dettagliate su veleni e armi biologiche a diversi utenti.

AI · 3 min di lettura