Nel confronto via API pubblicato il 26 settembre 2026, Claude Opus 5.5 e Claude Opus 5 hanno ottenuto gli stessi risultati nelle tre attività: entrambi hanno risolto una griglia logica e un gioco delle pietre, mentre nessuno dei due ha risposto a un problema di ordinamento con vincoli. Nel test, Opus 5.5 ha raggiunto una velocità aggregata di generazione superiore di circa l’11%.

Come si è svolto il confronto

Le due versioni hanno ricevuto prompt identici tramite l’API di Anthropic, con il ragionamento adattivo al livello di impegno predefinito. Ogni problema è stato eseguito una sola volta per modello. I token di output sono le unità di testo generate dal modello; il tasso di generazione indica quanti ne produce al secondo.

I risultati delle tre attività

AttivitàClaude Opus 5.5Claude Opus 5
Griglia logica28/2828/28
Gioco delle pietre3/3 risposte corrette3/3 risposte corrette
Ordinamento con vincoliNessuna risposta ai limiti di output testatiNessuna risposta ai limiti di output testati

Il problema di ordinamento è stato provato con limiti di output di 48.000 e 128.000 token; nessuno dei due modelli ha fornito una risposta. La griglia logica e il gioco delle pietre hanno invece prodotto esiti uguali per entrambi.

Velocità misurata e dichiarazione di Anthropic

Nel confronto, il tasso aggregato è stato di 103,4 token al secondo per Claude Opus 5.5 e di 93,1 per Claude Opus 5: una differenza di circa l’11% a favore del modello più recente in queste chiamate.

Anthropic sostiene che Opus 5.5 generi output oltre il 30% più velocemente di Opus 5. Questa è una dichiarazione dell’azienda; il dato dell’11% riguarda i tassi aggregati misurati nel confronto, che ha coperto tre problemi specifici con una sola esecuzione per modello e per problema.