Anthropic ha annunciato Claude Sonnet 5.5 il 28 settembre 2026: è il secondo modello della famiglia Claude 5.5 e punta a lavori quotidiani ben definiti, dalla programmazione alla preparazione di documenti e fogli di calcolo. L’azienda sostiene che genera output oltre il 30% più velocemente di Sonnet 5 e che, per la maggior parte delle attività, può costare fino al 30% in meno.

Il posto di Sonnet 5.5 nella famiglia

Anthropic presenta Sonnet 5.5 come una scelta per attività circoscritte, come correggere bug, scrivere codice, creare presentazioni e progettare interfacce. Claude Opus 5.5 è invece destinato, nella descrizione dell’azienda, a lavori complessi e aperti che richiedono giudizio prolungato.

Il modello ID per l’API è claude-sonnet-5-5. Anthropic ha anche descritto salvaguardie per la cybersicurezza: nelle attività ad alto rischio il sistema passa visibilmente a Sonnet 5, mentre lo sviluppo software di routine resta disponibile.

Tariffe API e costo per attività

Anthropic indica tariffe API di 2 dollari statunitensi per milione di token in ingresso, 10 dollari per milione in uscita e 0,20 dollari per milione di token letti dalla cache. Per scrivere token nella cache, la tariffa indicata è di 2,50 dollari per milione. Le prime tre tariffe sono le stesse elencate per Sonnet 5.

Il prezzo per token e il costo di un’attività completata misurano cose diverse: il secondo dipende dai token consumati durante il lavoro. Il risparmio fino al 30% dichiarato da Anthropic riguarda Sonnet 5, non Opus 5.5. In una valutazione a effort Max, il costo stimato per attività in un indice di dieci prove era invece di 7,60 dollari per Sonnet 5.5 e 5,98 dollari per Opus 5.5: una stima legata a quel carico di lavoro, non una tariffa API.

Anche le impostazioni predefinite variano in base al prodotto: l’app Claude e Claude Code usano effort Medium, mentre Claude Platform usa effort High.

Come si confrontano i benchmark

I risultati cambiano da una valutazione all’altra. In CursorBench 4.0, Anthropic ha riportato il 55,5% per Sonnet 5.5 e il 57,8% per Opus 5.5. Nella stessa tabella, i punteggi di GDPval-AA v2.1 sono espressi su una scala di tipo Elo.

ValutazioneClaude Sonnet 5.5Claude Opus 5.5
CursorBench 4.055,5%57,8%
GDPval-AA v2.1 (punteggio di tipo Elo)1.8441.846

Per GDPval-AA v2.1, la prova preliminare di Sonnet 5.5 era interessata da un bug nell’output strutturato, corretto prima del lancio. Anthropic si aspettava che l’effetto sul punteggio fosse contenuto.

Anche Terminal-Bench 4.0 richiede di tenere conto delle impostazioni: Anthropic ha riportato il 70,6% per Sonnet 5.5 e il 66,4% per Opus 5.5, specificando che il risultato di Opus è stato ottenuto con effort Xhigh. I due punteggi non rappresentano quindi un confronto a parità di effort.

Piattaforme e prossimo modello

Anthropic ha dichiarato che Claude Sonnet 5.5 era disponibile su tutte le piattaforme, tra cui Amazon Web Services, Google Cloud e Microsoft Azure. Nell’annuncio del 28 settembre, ha inoltre detto che Claude Haiku 5.5 si sarebbe aggiunto alla famiglia nelle settimane successive, senza indicare una data precisa.