Een benchmarkupdate van 8 oktober zette Claude Haiku 5.5 (max) op $0,21 per gewogen taak in de Intelligence Index, bij een score van 43. Anthropic rekent API-gebruik af per miljoen tokens; het benchmarkbedrag is dus geen vast tarief voor een willekeurige opdracht.

Wat de benchmarkkosten per taak meten

De Intelligence Index-kostprijs is een gewogen gemiddelde over benchmarktaken. De berekening telt input, gecachte input, cachewrites, redeneertokens en antwoordtokens mee. De $0,21 hoort bij Claude Haiku 5.5 op maximale inspanning en bij de score 43.

Anthropic bracht Claude Haiku 5.5 uit op 7 oktober 2026. De benchmarkmaatstaf beantwoordt een andere vraag dan de API-prijslijst: wat de modelaanroepen in een specifieke evaluatie gemiddeld kosten, tegenover wat afzonderlijke tokens volgens de API-tarieven kosten.

Anthropic rekent per promptlengte en tokensoort

Anthropic hanteert twee API-prijsschijven op basis van de promptlengte. De tarieven hieronder zijn in Amerikaanse dollars per miljoen tokens.

PromptlengteInput per miljoen tokensOutput per miljoen tokens
Tot en met 100.000 tokens$0,10$0,50
Meer dan 100.000 tokens$0,50$2,50

De grens voor de lagere prijsschijf is 100.000 prompttokens. Dat is iets anders dan de contextlengte: Anthropic vermeldt voor Claude Haiku 5.5 een contextvenster van 1 miljoen tokens.

Een eenvoudige berekening maakt het verschil concreet. Een verzoek met 10.000 inputtokens en 1.000 outputtokens kost zonder caching $0,0015: $0,001 voor input en $0,0005 voor output. Bij een prompt van 120.000 inputtokens en 2.000 outputtokens komt de berekening met de hogere tarieven uit op $0,065. Dit zijn voorbeelden op basis van tokenverbruik; de uiteindelijke rekening hangt af van de tokens en toepasselijke tarieven.

Wie cache gebruikt, krijgt aparte tarieven. Cache lezen kost $0,01 per miljoen tokens in de lagere schijf en $0,05 erboven. Cache schrijven kost voor vijf minuten respectievelijk $0,125 en $0,625 per miljoen tokens; voor één uur is dat $0,20 en $1,00. Anthropic vermeldt daarnaast een korting van 50% op input- en outputprijzen via de Batch API.

De eerdere uitleg over de twee API-prijsschijven van Haiku 5.5 behandelt de lancering en de tarieven; de benchmarkkost per taak is een afzonderlijke maatstaf.

De gerapporteerde vergelijking met GPT-6 Luna

Bij een vergelijkbare score onder maximale inspanning kwam GPT-6 Luna in een gerapporteerde vergelijking uit op ongeveer een derde van de kosten van Haiku 5.5. Dat resultaat geldt voor die benchmark en die inspanningsinstelling.

Een afzonderlijk gerapporteerd resultaat bij hoge inspanning zette beide modellen op score 38. Haiku 5.5 gebruikte daarbij circa 55.000 outputtokens per taak, tegenover circa 50.000 voor GPT-6 Luna. De bedragen en tokenaantallen horen bij verschillende benchmarkuitkomsten; ze vormen geen universele prijsvergelijking voor eigen API-verzoeken.

Wat de kosten van een API-taak bepaalt

Voor een gewone API-taak bepalen vooral de input- en outputtokens de rekening. Ook promptlengte speelt mee, omdat prompts boven 100.000 tokens in de hogere prijsschijf vallen. Caching kan de tarieven veranderen, en redeneertokens tellen mee in het verbruik.

Claude Haiku 5.5 ondersteunt adaptief denken en een instelbare inspanning; Anthropic noemt gemiddeld de standaardinstelling. Een hogere inspanning kan het tokenverbruik en daarmee de totale kosten beïnvloeden. Anthropic zegt bovendien dat de tokenizer van Haiku 5.5 dezelfde tekst ongeveer 30% meer tokens laat tellen dan die van Haiku 4.5. Dat verschil betreft het aantal tokens voor dezelfde tekst, terwijl een concrete taakprijs afhangt van het werkelijke verbruik en de gebruikte functies.