Indice
- Claude Opus 5.5 punta soprattutto sul coding
- Anche i benchmark premiano l’efficienza
- Quanto costa Claude Opus 5.5
- La pressione sui prezzi dell’intelligenza artificiale
- Anthropic aumenta anche i limiti di utilizzo
- Claude Opus 5.5 dovrebbe anche comunicare meglio
- Sicurezza: Opus 5.5 viene distribuito con protezioni aggiuntive
- Accesso alla biologia e alla cybersicurezza
- Arrivano anche Sonnet 5.5 e Haiku 5.5
- Un modello che punta meno alla forza bruta e più all’efficienza
Anthropic presenta Claude Opus 5.5, il nuovo modello di punta: più veloce, più efficiente e con costi inferiori rispetto a Opus 5.
Anthropic ha presentato Claude Opus 5.5, il nuovo modello di punta della famiglia Claude 5.5 e successore diretto di Opus 5. L’azienda lo posiziona come un modello capace di avvicinarsi alle prestazioni di Claude Fable 5.1, ma con un costo operativo inferiore del 40% sui carichi di lavoro tipici.
Il nuovo modello arriva in un momento particolarmente delicato per il settore dell’intelligenza artificiale. È infatti il primo modello rilasciato da Anthropic dopo l’appello del CEO Dario Amodei per rallentare lo sviluppo dell’IA di frontiera e permettere ai sistemi di sicurezza di tenere il passo con l’aumento delle capacità dei modelli.
La novità, quindi, non riguarda soltanto il numero della versione. Opus 5.5 punta soprattutto su tre elementi: capacità di coding agentico, efficienza economica e sicurezza.
Claude Opus 5.5 punta soprattutto sul coding
Una delle aree nelle quali Anthropic ha concentrato maggiormente lo sviluppo è quella della programmazione.
Secondo i test interni dell’azienda, Opus 5.5 sarebbe stato in grado di completare una migrazione di codice composta da 680.000 righe in meno di una giornata. Si tratta di un’attività che, secondo Anthropic, avrebbe richiesto settimane di lavoro a un intero team di sviluppatori.
In un altro test dedicato all’ottimizzazione dei tempi di caricamento di un’applicazione web, il modello ha ottenuto risultati positivi in 39 casi su 40. Il precedente Opus 5, invece, aveva prodotto miglioramenti più limitati e in alcuni casi aveva modificato anche il comportamento dell’applicazione.
Il dato più interessante riguarda però il coding agentico, cioè la capacità del modello di affrontare attività di sviluppo più lunghe e articolate con un livello maggiore di autonomia.
In un test, Opus 5.5 ha revisionato e corretto una codebase di 200.000 righe in meno di tre ore. Lo stesso lavoro, secondo i dati diffusi da Anthropic, aveva richiesto a Opus 5 più di 20 ore e circa 2,5 volte il numero di token.
Non si tratta quindi semplicemente di generare una funzione o correggere poche righe di codice. Il modello viene presentato come uno strumento in grado di intervenire su progetti software molto più complessi.
Anche i benchmark premiano l’efficienza
Anthropic ha messo a confronto Opus 5.5 con altri modelli nei benchmark dedicati al coding agentico. Secondo i risultati forniti dall’azienda, Opus 5.5 supera GPT-6 Astra su FrontierCode utilizzando il livello di sforzo predefinito e sostenendo circa il 20% del costo per attività. Su Terminal Bench 4.0, invece, raggiunge un risultato equivalente a quello di Astra spendendo circa il 40%.
Su CursorBench, il confronto indicato da Anthropic vede Opus 5.5 davanti a GPT-5.6 Sol di 11 punti percentuali, con un costo pari a circa un terzo.
Sono naturalmente dati prodotti e selezionati dalla stessa Anthropic e vanno quindi letti come risultati dichiarati dall’azienda, non come una classifica indipendente di tutti i modelli disponibili.
Il punto centrale della presentazione è comunque evidente: non basta più aumentare le capacità di un modello, bisogna anche ridurre quanto costa utilizzarlo.
Quanto costa Claude Opus 5.5
Ed è proprio sul prezzo che Anthropic ha introdotto una delle novità più importanti. Con Opus 5.5, i token in input vengono tariffati 4 dollari per milione, mentre quelli in output costano 20 dollari per milione. Rispetto a Opus 5, si tratta di una riduzione del 20%.
Ancora più significativa è la diminuzione del costo delle letture dalla cache, che scende a 0,20 dollari per milione di token, il 60% in meno rispetto alla generazione precedente.
La cache è particolarmente importante negli scenari di coding e utilizzo agentico, nei quali il modello può dover lavorare ripetutamente sullo stesso contesto.
Per sviluppatori e aziende che utilizzano Claude attraverso API, quindi, la riduzione può avere un impatto significativo sul costo complessivo delle operazioni.
Anthropic dichiara inoltre che Opus 5.5 genera gli output oltre il 30% più velocemente rispetto a Opus 5. Il risultato è una combinazione di tre fattori: modello più efficiente, prezzi inferiori e maggiore velocità.
La pressione sui prezzi dell’intelligenza artificiale
La strategia di Anthropic arriva in un mercato nel quale il rapporto tra prestazioni e costi è diventato sempre più importante.
L’azienda sottolinea infatti la pressione esercitata dai modelli cinesi, che hanno investito molto sull’efficienza e sulla riduzione dei costi, cercando di mantenere prestazioni elevate. Questo sta cambiando la competizione nel settore.
Per un’azienda che utilizza un modello attraverso API, infatti, non è sufficiente sapere quale sistema ottiene il risultato migliore in assoluto. Conta anche quanto costa ottenere quel risultato, quanti token sono necessari e quanto tempo serve per completare il lavoro.
Nel caso di attività ripetitive o agentiche, piccole differenze di costo possono trasformarsi in differenze significative sulla spesa complessiva.
Anthropic aumenta anche i limiti di utilizzo
Le novità di Opus 5.5 non riguardano soltanto le API. Anthropic ha annunciato anche soglie di utilizzo più elevate per gli abbonamenti Pro, Max, Team e per il piano Enterprise a postazioni nominative.
I limiti vengono normalmente rinnovati ogni cinque ore e determinano quanto è possibile utilizzare Claude prima di dover attendere il successivo reset. L’azienda ha inoltre modificato il funzionamento del token che permette di azzerare immediatamente il conteggio della finestra di cinque ore.
Gli abbonati possono ora conservarlo e decidere autonomamente quando utilizzarlo, invece di doverlo attivare immediatamente dopo averlo ricevuto. È una modifica meno appariscente rispetto ai benchmark, ma potenzialmente molto importante per chi utilizza Claude intensivamente durante una giornata di lavoro.
Claude Opus 5.5 dovrebbe anche comunicare meglio
Anthropic ha lavorato anche sul comportamento conversazionale. Secondo l’azienda, Opus 5.5 produce risposte più chiare, porta le informazioni più importanti all’inizio e utilizza un linguaggio meno ricco di gergo rispetto a Opus 5.
È un cambiamento che nasce, almeno in parte, dai feedback ricevuti dagli utenti della generazione precedente. L’obiettivo è rendere il modello non soltanto più capace nell’esecuzione dei compiti, ma anche più semplice da utilizzare nelle interazioni quotidiane.
Sicurezza: Opus 5.5 viene distribuito con protezioni aggiuntive
L’altro grande tema è quello della sicurezza. Anthropic afferma che Opus 5.5 raggiunge capacità in ambito biologico e di cybersicurezza comparabili a quelle di Claude Mythos 5.1, il livello sperimentale dell’azienda.
Per questo motivo il modello viene distribuito con misure di protezione analoghe a quelle già applicate a Fable 5.1. La scelta è particolarmente significativa considerando il momento in cui arriva il modello.
Opus 5.5 è infatti il primo rilascio di Anthropic successivo all’appello di Dario Amodei per un rallentamento nello sviluppo dei sistemi di IA più avanzati, con l’obiettivo dichiarato di permettere alle procedure di sicurezza di mantenere il passo con le capacità tecnologiche.
Prima del lancio, il modello è stato sottoposto anche a valutazioni da parte di soggetti esterni indipendenti, tra cui METR e Frontier Design. Anthropic afferma inoltre che Opus 5.5 ha ottenuto il punteggio più alto mai registrato dalla società nel proprio test interno di allineamento.
Accesso alla biologia e alla cybersicurezza
Le capacità avanzate in questi settori hanno portato Anthropic a introdurre programmi di accesso specifici. Le organizzazioni verificate possono già richiedere l’accesso al Life Sciences Verification Program per utilizzare il modello nella ricerca biologica.
Nelle settimane successive è previsto inoltre un ampliamento del Cyber Verification Program, dedicato ai professionisti della sicurezza informatica verificati.
La logica è quella di non trattare allo stesso modo tutti gli utilizzi di un modello particolarmente potente. Alcuni ambiti possono richiedere verifiche aggiuntive prima di consentire l’accesso alle capacità più avanzate.
Arrivano anche Sonnet 5.5 e Haiku 5.5
Opus 5.5 è soltanto il primo componente della nuova generazione. Anthropic ha confermato che Claude Sonnet 5.5 e Claude Haiku 5.5, rispettivamente il modello intermedio e quello più leggero della famiglia, arriveranno nelle settimane successive.
L’azienda promette anche per questi modelli una parte dei miglioramenti introdotti con Opus 5.5, soprattutto sul fronte delle prestazioni, dell’efficienza e della sicurezza.
Per Opus 5.5, invece, la disponibilità è immediata sulle piattaforme supportate, comprese Amazon Web Services, Google Cloud e Microsoft Azure. Gli sviluppatori che utilizzano direttamente la piattaforma Anthropic possono accedere al modello tramite la stringa claude-opus-5-5.
Un modello che punta meno alla forza bruta e più all’efficienza
Claude Opus 5.5 racconta bene come stia cambiando la competizione tra i grandi modelli di intelligenza artificiale. La corsa non riguarda più soltanto il raggiungimento del punteggio più alto in un benchmark. Per gli sviluppatori che costruiscono agenti e applicazioni basate sull’IA contano sempre di più costo per attività, velocità, quantità di token utilizzati e capacità di completare autonomamente lavori complessi.
Anthropic sta quindi cercando di rendere Opus 5.5 competitivo su entrambi i fronti: prestazioni elevate e maggiore efficienza.
I dati diffusi dall’azienda dovranno naturalmente essere verificati attraverso benchmark indipendenti e utilizzi reali. Ma il messaggio del lancio è chiaro: con Claude Opus 5.5, Anthropic non sta semplicemente presentando un nuovo modello più potente. Sta cercando di dimostrare che un modello avanzato può anche diventare sensibilmente più economico da utilizzare.
