Eine am 8. Oktober 2026 veröffentlichte Intelligence-Index-Auswertung beziffert Claude Haiku 5.5 (max) mit 0,21 US-Dollar pro gewichteter Benchmark-Aufgabe und einem Score von 43. Das ist ein Ergebnis für den Benchmark – die Anthropic-API berechnet ihre Nutzung dagegen nach Tokens, Promptlänge und weiteren Abrechnungsfaktoren.

Was die Benchmark-Aufgabenkosten messen

Der Wert von 0,21 US-Dollar fasst die Kosten pro Aufgabe über gewichtete Intelligence-Index-Auswertungen zusammen. Dabei fließen Eingabe-Tokens, Cache-Lesezugriffe und -Schreibvorgänge sowie Denk- und Antwort-Tokens ein. Der Wert bezieht sich auf Haiku 5.5 bei maximalem Denkaufwand; er ist keine Pauschale für eine beliebige Anfrage.

Das macht den Unterschied zwischen zwei häufig verwechselten Größen greifbar: Ein Tokenpreis gibt an, was eine bestimmte Menge verarbeiteter Eingabe oder Ausgabe kostet. Kosten pro Aufgabe bündeln den Verbrauch, der für eine konkrete Benchmark-Aufgabe anfällt. Je nach Aufgabenstellung und Tokenmenge kann eine API-Anfrage daher anders zu Buche schlagen.

Anthropics API-Preise nach Promptlänge

Anthropic staffelt die API-Preise nach der Promptlänge. Bis einschließlich 100.000 Tokens gelten die niedrigeren Tarife; bei längeren Prompts greift die höhere Stufe. Die Beträge sind US-Dollar je eine Million Tokens und gelten getrennt für Eingabe und Ausgabe.

PromptlängeEingabe pro 1 Million TokensAusgabe pro 1 Million Tokens
Bis einschließlich 100.000 Tokens0,10 US-Dollar0,50 US-Dollar
Über 100.000 Tokens0,50 US-Dollar2,50 US-Dollar

Ein Beispiel für die niedrigere Stufe: 10.000 Eingabe-Tokens kosten 0,001 US-Dollar, 1.000 Ausgabe-Tokens 0,0005 US-Dollar. Zusammen sind das 0,0015 US-Dollar, sofern kein Cache-Tarif hinzukommt. Bei 120.000 Eingabe-Tokens und 2.000 Ausgabe-Tokens ergeben die höheren Tarife 0,06 plus 0,005, also 0,065 US-Dollar.

Die Million-Tokens-Tarife sind nicht die einzigen Kostenposten. Anthropic berechnet Cache-Lesezugriffe mit 0,01 beziehungsweise 0,05 US-Dollar pro Million Tokens, je nach Promptstufe. Cache-Schreibvorgänge kosten bei einer Speicherdauer von fünf Minuten 0,125 beziehungsweise 0,625 US-Dollar und bei einer Stunde 0,20 beziehungsweise 1,00 US-Dollar pro Million Tokens. Für Eingabe und Ausgabe über die Batch-API nennt Anthropic einen Rabatt von 50 Prozent.

Das Kontextfenster von Haiku 5.5 umfasst eine Million Tokens. Die Preisstufe richtet sich trotzdem nach der Promptlänge: Die größere Kontextkapazität hebt die Grenze von 100.000 Tokens nicht auf.

Der berichtete Vergleich mit GPT-6 Luna

Im berichteten Vergleich erreichte GPT-6 Luna bei ähnlichem Score unter maximalem Denkaufwand ungefähr ein Drittel der Kosten von Haiku 5.5. Das Ergebnis gilt für diesen Benchmark und diese Einstellung.

Bei einem Score von 38 lagen die berichteten Ausgabemengen im Vergleich mit hohem Denkaufwand bei rund 55.000 Tokens pro Aufgabe für Haiku 5.5 und rund 50.000 für GPT-6 Luna. Die Zahlen beschreiben den jeweiligen Benchmarklauf; sie sagen nicht voraus, wie viele Tokens ein anderes Modell oder eine andere Aufgabe benötigt.

Was die API-Rechnung beeinflusst

Für eine konkrete API-Aufgabe zählen zunächst Eingabe- und Ausgabevolumen sowie die Promptstufe. Hinzu kommen mögliche Cache-Nutzung und die gewählte Batch-Abrechnung. Claude Haiku 5.5 unterstützt adaptives Denken; Anthropic nennt mittleren Denkaufwand als Standardeinstellung. Mehr Denkaufwand kann den Tokenverbrauch und damit die Rechnung verändern.

Auch die Tokenisierung spielt eine Rolle: Anthropic gibt an, dass der neuere Tokenizer denselben Text im Vergleich zu Haiku 4.5 mit ungefähr 30 Prozent mehr Tokens zählt. Das betrifft die Tokenzählung, nicht pauschal die Kosten jeder Aufgabe.

Anthropic veröffentlichte Claude Haiku 5.5 am 7. Oktober 2026. Die frühere NeoTeo-Meldung zu den gestaffelten API-Tarifen von Claude Haiku 5.5 behandelte den Modellstart; die Intelligence-Index-Auswertung folgte am 8. Oktober.