Un aggiornamento pubblicato l’8 ottobre sui risultati dell’Intelligence Index attribuisce a Claude Haiku 5.5 (max) un costo ponderato di 0,21 dollari per task e un punteggio di 43. È una media ottenuta nel benchmark, non il prezzo fisso di una normale richiesta API: Anthropic fattura input e output in base ai token utilizzati e alla lunghezza del prompt.

Anthropic aveva rilasciato Claude Haiku 5.5 il 7 ottobre. Per il contesto del lancio e delle fasce tariffarie, NeoTeo aveva già presentato il modello e i suoi prezzi API.

Che cosa misura il costo per task del benchmark

Un costo per task di benchmark è una media calcolata sulle attività di una valutazione, non una tariffa valida per qualsiasi lavoro affidato al modello. Il valore di 0,21 dollari riguarda Claude Haiku 5.5 con effort massimo: l’Intelligence Index gli attribuisce anche 43 punti.

Il calcolo pondera i risultati delle diverse valutazioni e comprende token di input, letture e scritture della cache, token di ragionamento e risposte. Perciò descrive il costo delle attività considerate dal benchmark; una richiesta API concreta può consumare una quantità diversa di token e avere un costo diverso.

Le tariffe API di Anthropic in base al prompt

Anthropic pubblica le tariffe API in dollari statunitensi per milione di token. La fascia dipende dalla lunghezza del prompt: fino a 100.000 token si applicano i prezzi più bassi; oltre tale soglia, le tariffe di input e output sono cinque volte maggiori.

Lunghezza del promptInput per 1 milione di token (USD)Output per 1 milione di token (USD)
Fino a 100.000 token0,100,50
Oltre 100.000 token0,502,50

Per esempio, 10.000 token in input e 1.000 in output costano 0,0015 dollari nella fascia più bassa, senza uso della cache: 0,001 dollari per l’input e 0,0005 per l’output. Con 120.000 token nel prompt e 2.000 in output, il calcolo alle tariffe superiori dà 0,065 dollari: 0,06 per l’input e 0,005 per l’output.

La finestra di contesto dichiarata per Haiku 5.5 è di un milione di token; la soglia tariffaria di 100.000 token è un parametro distinto. Anche la cache ha prezzi separati: la lettura costa 0,01 o 0,05 USD per milione di token, mentre le scritture costano 0,125 o 0,625 USD per cinque minuti e 0,20 o 1 USD per un’ora, rispettivamente nelle due fasce di prompt. Anthropic indica inoltre uno sconto del 50% sui prezzi di input e output per le richieste tramite Batch API.

Il confronto riportato con GPT-6 Luna

Nel confronto riportato, GPT-6 Luna avrebbe raggiunto un punteggio simile a effort massimo con un costo per task pari a circa un terzo di quello di Haiku 5.5. È un risultato legato a quella valutazione e a quelle impostazioni.

A effort alto, il confronto riportato attribuisce a entrambi i modelli un punteggio di 38. Haiku 5.5 avrebbe generato circa 55.000 token in output per task, contro circa 50.000 per GPT-6 Luna. Questi dati descrivono il consumo di token e il punteggio in quel confronto; non stabiliscono un costo preciso per Luna a quel livello.

Da cosa dipende il costo di una chiamata API

Il conto dipende dal numero di token in input e in output, dalla fascia determinata dalla lunghezza del prompt e dall’eventuale uso della cache o della Batch API. Anche l’effort conta: Haiku 5.5 supporta il ragionamento adattivo e un parametro per regolarlo, impostato di default su medio. Un livello di ragionamento più alto può aumentare i token consumati.

Anthropic afferma che il tokenizer di Haiku 5.5 conteggia circa il 30% di token in più rispetto a quello di Haiku 4.5 a parità di testo. Poiché la fatturazione dipende dai token conteggiati, anche questa differenza può incidere sul costo di una richiesta.