Nel confronto via API pubblicato il 26 settembre 2026, Claude Opus 5.5 e Claude Opus 5 hanno ottenuto gli stessi risultati nelle tre attività: entrambi hanno risolto una griglia logica e un gioco delle pietre, mentre nessuno dei due ha risposto a un problema di ordinamento con vincoli. Nel test, Opus 5.5 ha raggiunto una velocità aggregata di generazione superiore di circa l’11%.
Come si è svolto il confronto
Le due versioni hanno ricevuto prompt identici tramite l’API di Anthropic, con il ragionamento adattivo al livello di impegno predefinito. Ogni problema è stato eseguito una sola volta per modello. I token di output sono le unità di testo generate dal modello; il tasso di generazione indica quanti ne produce al secondo.
I risultati delle tre attività
| Attività | Claude Opus 5.5 | Claude Opus 5 |
| Griglia logica | 28/28 | 28/28 |
| Gioco delle pietre | 3/3 risposte corrette | 3/3 risposte corrette |
| Ordinamento con vincoli | Nessuna risposta ai limiti di output testati | Nessuna risposta ai limiti di output testati |
Il problema di ordinamento è stato provato con limiti di output di 48.000 e 128.000 token; nessuno dei due modelli ha fornito una risposta. La griglia logica e il gioco delle pietre hanno invece prodotto esiti uguali per entrambi.
Velocità misurata e dichiarazione di Anthropic
Nel confronto, il tasso aggregato è stato di 103,4 token al secondo per Claude Opus 5.5 e di 93,1 per Claude Opus 5: una differenza di circa l’11% a favore del modello più recente in queste chiamate.
Anthropic sostiene che Opus 5.5 generi output oltre il 30% più velocemente di Opus 5. Questa è una dichiarazione dell’azienda; il dato dell’11% riguarda i tassi aggregati misurati nel confronto, che ha coperto tre problemi specifici con una sola esecuzione per modello e per problema.