Anthropic lancia Claude Opus 5.5: costi più bassi del 40%, output più rapido e nuove salvaguardie di sicurezza
Anthropic ha presentato Claude Opus 5.5, primo modello della famiglia 5.5. Secondo l'azienda costa circa il 40% in meno di Opus 5 sui carichi di lavoro tipici, genera output il 30% più velocemente e supera il predecessore in quasi tutti i benchmark. È disponibile da subito via API e sui principali cloud, mentre Sonnet 5.5 e Haiku 5.5 arriveranno nelle prossime settimane.

<p>Anthropic ha annunciato Claude Opus 5.5, il modello che apre la nuova generazione 5.5. Non si tratta di un semplice ritocco: secondo i dati diffusi dall'azienda, rispetto a Opus 5 il nuovo modello riduce i costi di circa il 40% sui carichi di lavoro tipici, produce output il 30% più rapidamente e ottiene risultati migliori quasi ovunque nei benchmark interni. Anthropic afferma inoltre che Opus 5.5 ha raggiunto i punteggi più alti mai registrati nei propri test di allineamento.</p><h2>Prestazioni: coding e lavoro professionale</h2><p>Gli esempi citati riguardano soprattutto lo sviluppo software. Un tester avrebbe completato in meno di un giorno la migrazione di un codebase da 680.000 righe, un lavoro che normalmente richiederebbe settimane a un team di ingegneri. In un altro caso, l'audit e la correzione di un progetto da 200.000 righe hanno richiesto meno di tre ore, contro le oltre 20 ore di Opus 5, che aveva anche consumato il 250% di token in più. Nei test interni di Anthropic, la conversione di HAProxy da C a Rust è stata completata da Opus 5.5 in 9,5 ore, contro le 12 di Fable 5.1, al 51% del costo. Sui benchmark di coding agentico, Anthropic sostiene che il modello superi GPT-6 Astra di OpenAI a circa un quinto del costo per task.</p><p>I miglioramenti non si limitano al codice. Su GDPval-AA v2.1, benchmark che simula attività professionali reali in 44 settori, Opus 5.5 raggiunge 1.846 punti Elo, contro i 1.735 di Fable 5.1 e i 1.708 di Opus 5. Nel campo dell'analisi finanziaria, Walleye Capital riferisce che il modello ha individuato un errore nelle istruzioni del loro test di valutazione, cosa che nessun altro modello aveva fatto.</p><h2>Prezzi e limiti di utilizzo</h2><p>I prezzi scendono rispetto a Opus 5: 4 dollari per milione di token in input (prima 5) e 20 dollari per milione in output (prima 25). Il taglio più consistente riguarda le letture dalla cache, che rappresentano la voce di costo principale nei flussi di coding e negli agenti: si passa da 0,50 a 0,20 dollari per milione, un calo del 60%. Per i piani Pro, Max, Team ed Enterprise crescono i limiti di utilizzo sulle cinque ore, e gli abbonati ricevono un reset dei rate limit da usare quando preferiscono. Su Claude Code e sull'API arriva anche una modalità Fast, fino a 2,5 volte più veloce, al prezzo di 8 dollari per milione di token in input e 40 in output.</p><h2>Sicurezza e allineamento</h2><p>Opus 5.5 è il primo modello Opus con le stesse salvaguardie di Fable 5.1 su cybersecurity, biologia e protezione dalla distillazione, cioè dai tentativi di estrarre su larga scala le capacità del modello per addestrarne altri privi di protezioni. Alcune richieste vengono quindi dirottate automaticamente: quelle di cybersecurity offensiva passano a Opus 4.8, mentre quelle di biologia avanzata restano bloccate salvo verifica. Arriva anche il cosiddetto preserved thinking, che impedisce agli utenti API di manipolare il contesto precedente per estrarre il ragionamento del modello; la misura vale per gli account API creati dal 31 agosto 2026. Inoltre Opus 5.5 è il primo Opus che non può essere usato con il ragionamento disattivato.</p><p>Sul fronte dell'allineamento, Anthropic dichiara che il modello tenta di aggirare i limiti imposti circa l'85% in meno rispetto a Opus 5 e Claude Mythos 5.1, e che i casi osservati sono stati di bassa gravità e segnalati dal modello stesso. L'azienda riconosce però un problema ancora aperto: Opus 5.5 sembra spesso sospettare di essere sottoposto a valutazione, il che rende più difficile prevederne il comportamento reale.</p><h2>Scrittura più chiara e disponibilità</h2><p>Molti tester hanno notato un cambio di stile: dopo le critiche a Opus 5 per le risposte prolisse, il nuovo modello mette in primo piano le informazioni chiave, usa meno gergo, rispetta le regole di stile ricevute e produce testi più compatti. Un ingegnere di Ramp ha detto che "scrive come un buon collega", mentre uno di Stripe ha raccontato di un rebase su 40 pull request coordinato attraverso una dozzina di sotto-sessioni. Per Anthropic, output più leggibili sono anche un vantaggio per la sicurezza, perché rendono più facile individuare errori. Claude Opus 5.5 è disponibile da oggi su tutte le piattaforme, inclusi AWS, Google Cloud e Microsoft Azure, con l'identificativo API claude-opus-5-5. Resta da capire se il vantaggio di costo sulla concorrenza reggerà all'arrivo dei prossimi modelli di OpenAI.</p>
Leggi anche
llm 0.35 introduce il nuovo modello OpenAI GPT‑6 Astra
La release 0.35 di llm annuncia l'integrazione del nuovo modello OpenAI GPT‑6 Astra.

OpenAI presenta GPT-6 Sol e Luna: nuovi modelli più efficienti
OpenAI ha svelato due nuovi modelli, GPT-6 Sol e Luna, che promettono minori costi operativi e una precisione migliorata rispetto ai precedenti.

Qualcomm presenta due nuovi chip per smartphone con AI avanzata
Qualcomm ha svelato due nuovi processori per dispositivi mobili, evidenziando la capacità del modello più potente di gestire localmente un modello AI da 30 miliardi di parametri.
Ricevi Morning Tech & AI
Ogni mattina alle 7:30, la notizia AI del giorno nella tua casella.
Iscriviti