W porównaniu opublikowanym 8 października 2026 r. Claude Haiku 5.5 (max) uzyskał 43 punkty w Intelligence Index, a jego ważony koszt wyniósł 0,21 USD za zadanie. To wynik benchmarku, nie cena pojedynczego, dowolnego wywołania API. Anthropic rozlicza API według liczby tokenów i długości promptu.

Co mierzy koszt zadania w benchmarku

Intelligence Index ocenia modele na zestawie zadań. Koszt zadania to średnia ważona dla tej konkretnej ewaluacji: uwzględnia tokeny wejściowe, odczyty i zapisy pamięci podręcznej, tokeny rozumowania oraz odpowiedzi. Kwota 0,21 USD odnosi się do wyniku Claude Haiku 5.5 przy maksymalnym poziomie wysiłku, a nie do typowego zadania każdego użytkownika.

Model uzyskał w tym pomiarze 43 punkty. Koszt zależy od tego, jakie zadania wchodzą w skład benchmarku i ile tokenów model zużywa podczas ich rozwiązywania. Rzeczywisty rachunek za API trzeba więc liczyć na podstawie konkretnego użycia.

Stawki API Anthropic według długości promptu

Anthropic podaje osobne ceny tokenów wejściowych i wyjściowych. Próg cenowy wynosi 100 000 tokenów promptu: przy dłuższych promptach stawka za każdą z tych kategorii jest pięciokrotnie wyższa.

Długość promptuTokeny wejściowe za milionTokeny wyjściowe za milion
Do 100 000 tokenów włącznie0,10 USD0,50 USD
Powyżej 100 000 tokenów0,50 USD2,50 USD

Dla przykładu: prompt zawierający 10 000 tokenów wejściowych i odpowiedź o długości 1 000 tokenów kosztują łącznie 0,0015 USD, jeśli nie korzystają z pamięci podręcznej i prompt mieści się w niższym przedziale. Przy 120 000 tokenów wejściowych i 2 000 wyjściowych, w wyższym przedziale i bez cache, koszt wynosi 0,065 USD. W obu przypadkach opłata za wejście i wyjście jest obliczana osobno.

Pamięć podręczna ma własne stawki. Przy promptach do 100 000 tokenów odczyt kosztuje 0,01 USD za milion tokenów; zapis na 5 minut — 0,125 USD, a na godzinę — 0,20 USD. Powyżej progu stawki te wynoszą odpowiednio 0,05 USD, 0,625 USD i 1 USD za milion tokenów. Batch API obniża ceny tokenów wejściowych i wyjściowych o 50% względem standardowych stawek.

Co pokazało porównanie z GPT-6 Luna

W opisanym porównaniu GPT-6 Luna uzyskał wynik zbliżony do Haiku 5.5 przy maksymalnym poziomie wysiłku, ale jego koszt zadania wyniósł około jednej trzeciej kosztu Haiku. To rezultat tej konkretnej ewaluacji, a nie uniwersalna relacja kosztów dla wszystkich zastosowań.

Przy wysokim poziomie wysiłku oba modele osiągnęły 38 punktów. Haiku 5.5 zużywał wtedy około 55 000 tokenów wyjściowych na zadanie, a GPT-6 Luna około 50 000. Te liczby opisują tokeny wyjściowe w tym porównaniu; nie określają ceny każdego zadania API.

Co wpływa na rachunek za API

Poza długością promptu znaczenie mają liczba tokenów wejściowych i wyjściowych, użycie pamięci podręcznej oraz tokeny generowane podczas rozumowania. Claude Haiku 5.5 obsługuje adaptacyjne rozumowanie i parametr effort; Anthropic podaje średni poziom wysiłku jako ustawienie domyślne. Wyższy poziom może zmienić zużycie tokenów, a w konsekwencji koszt.

Anthropic podaje też, że tokenizer Claude Haiku 5.5 zlicza ten sam tekst jako około 30% więcej tokenów niż tokenizer Claude Haiku 4.5. To porównanie liczby tokenów dla tego samego tekstu, nie stała podwyżka rachunku dla każdego zadania. Model ma okno kontekstu o długości 1 miliona tokenów, ale wyższy limit kontekstu nie zmienia progu cenowego 100 000 tokenów.

Claude Haiku 5.5 zadebiutował 7 października 2026 r. Wcześniej opisaliśmy premierę modelu i jego stawki API.