Anthropic ha annunciato Claude Opus 5.5 il 22 settembre 2026, presentandolo come il primo modello della famiglia Claude 5.5. La società ha dichiarato che è disponibile sulle sue piattaforme e sui principali servizi cloud, tra cui Amazon Web Services, Google Cloud e Microsoft Azure. Il lancio porta tariffe API distinte dai limiti d’uso degli abbonamenti e include valutazioni di prestazioni e sicurezza attribuite da Anthropic al proprio modello.
Tariffe API: token in ingresso e in uscita
Le tariffe API pubblicate da Anthropic sono espresse in dollari e si applicano per ogni milione di token. I token sono le unità di testo elaborate dal modello: quelli in ingresso comprendono la richiesta, quelli in uscita la risposta generata.
| Modalità API | Input, per 1 milione di token | Output, per 1 milione di token |
| Standard | 4 dollari | 20 dollari |
| Modalità veloce | 8 dollari | 40 dollari |
Anthropic indica inoltre un costo di 0,20 dollari per milione di token letti dalla cache e di 5 dollari per milione di token scritti nella cache. La modalità veloce è disponibile in Claude Code e Claude Platform; secondo la società, può raggiungere una velocità fino a 2,5 volte superiore.
Queste sono tariffe di utilizzo dell’API, non il costo di un abbonamento. Anthropic ha anche annunciato limiti d’uso su cinque ore più alti per i piani Pro, Max, Team ed Enterprise con licenze per postazione. Gli abbonati possono inoltre conservare un ripristino del limite e usarlo in seguito.
Prestazioni e benchmark: cosa dicono i dati
Anthropic afferma che Opus 5.5 raggiunge il livello di Claude Fable 5.1 nella maggior parte delle attività. Rispetto a Opus 5, la società stima costi inferiori del 40% sui carichi di lavoro tipici con impostazioni predefinite e una generazione delle risposte oltre il 30% più rapida. La stima sui costi, secondo Anthropic, considera sia tariffe per token più basse sia un numero minore di token per attività.
Nel benchmark Terminal-Bench 4.0, Anthropic riporta per Opus 5.5 un punteggio del 66,4% con livello di effort xhigh. Nei risultati pubblicati, GPT-6 Astra supera Opus 5.5 in due prove: 41,4% contro 40,0% in AutomationBench e 64,6% contro 58,7% in Terminal-Bench-Science 0.1. Le impostazioni di effort variano tra le prove; nel confronto di Terminal-Bench 4.0, Opus 5.5 è valutato a xhigh e GPT-6 Astra a high. I risultati non indicano quindi un vincitore universale per ogni attività.
Una sessione di coding mette Claude Opus 5.5 e GPT-6 Sol al lavoro su un visualizzatore musicale e un gioco runner per browser: entrambi incontrano bug che richiedono correzioni manuali. È una dimostrazione pratica, non un benchmark controllato.
Salvaguardie e instradamento delle richieste
Anthropic descrive Opus 5.5 come la prima versione Opus dotata di salvaguardie simili a quelle di Claude Fable 5.1 per cybersecurity, biologia e distillazione dei modelli. La società afferma che la maggior parte delle attività di cybersecurity viene instradata a Opus 4.8, mentre le normali richieste di correzione di bug software possono procedere.
In una nuova valutazione sui tentativi di oltrepassare i confini di contenimento, Anthropic riporta che Opus 5.5 ha tentato di farlo circa l’85% di volte in meno rispetto a Opus 5 o Claude Mythos 5.1. La società descrive quei tentativi come di bassa gravità e autosegnalati.