Les résultats de l’Intelligence Index rapportés le 8 octobre 2026 attribuaient à Claude Haiku 5.5 (max) un score de 43 et un coût pondéré de 0,21 $ par tâche. Ce chiffre résume des tâches de benchmark ; une requête API, elle, est facturée selon les tokens consommés et la longueur du prompt.

Ce que mesure le coût par tâche du benchmark

Un coût par tâche de benchmark est une moyenne calculée sur les tâches d’une évaluation, et non le prix fixe d’une requête quelconque. Pour l’Intelligence Index, le calcul tient compte des tokens d’entrée, des lectures et écritures du cache, du raisonnement et des réponses, puis pondère les évaluations. Le résultat de 0,21 $ concerne Claude Haiku 5.5 à effort maximal.

La distinction compte dès qu’on passe à un usage réel : deux tâches peuvent mobiliser des volumes de tokens très différents. Le montant dépend aussi de la tranche tarifaire et, le cas échéant, du cache ou de l’API Batch.

Les tarifs API d’Anthropic selon la longueur du prompt

Anthropic affiche des tarifs distincts pour les tokens d’entrée et de sortie, exprimés en dollars américains par million de tokens. La tranche dépend de la longueur du prompt :

Longueur du promptEntrée par million de tokens (USD)Sortie par million de tokens (USD)
Jusqu’à 100 000 tokens0,10 $0,50 $
Plus de 100 000 tokens0,50 $2,50 $

Un token est une unité de texte traitée par le modèle. Par exemple, une requête avec 10 000 tokens d’entrée et 1 000 tokens de sortie, sans cache et sous le seuil de 100 000 tokens, revient à 0,0015 $ : 0,001 $ pour l’entrée et 0,0005 $ pour la sortie. Avec 120 000 tokens d’entrée et 2 000 tokens de sortie, sans cache, le tarif de la tranche supérieure donne 0,065 $ : 0,06 $ en entrée et 0,005 $ en sortie.

Anthropic affiche aussi des tarifs pour le cache : la lecture coûte 0,01 $ par million de tokens dans la tranche basse et 0,05 $ au-dessus du seuil. Les écritures de cache de cinq minutes coûtent respectivement 0,125 $ et 0,625 $ par million ; celles d’une heure, 0,20 $ et 1 $. L’API Batch réduit de 50 % les tarifs des tokens d’entrée et de sortie. Pour le contexte du lancement et les tarifs présentés à cette occasion, retrouvez notre article sur Claude Haiku 5.5 et ses tarifs API.

La comparaison rapportée avec GPT-6 Luna

Une comparaison rapportée le 8 octobre situe GPT-6 Luna à un score maximal similaire pour environ un tiers du coût de Haiku 5.5 dans l’Intelligence Index. Cette estimation concerne cette évaluation et son niveau d’effort maximal.

À effort élevé, la comparaison rapporte un score de 38 pour les deux modèles. Haiku 5.5 aurait consommé environ 55 000 tokens de sortie par tâche, contre environ 50 000 pour GPT-6 Luna. Ces chiffres décrivent les résultats de ce benchmark ; ils ne donnent pas le coût de chaque modèle pour une tâche API ordinaire.

Les facteurs qui font varier une facture API

Pour estimer une requête, il faut distinguer les tokens d’entrée de ceux de sortie et appliquer le tarif correspondant à la longueur du prompt. Les lectures et écritures du cache ont leurs propres prix. Le raisonnement compte aussi dans le volume utilisé : Haiku 5.5 prend en charge la réflexion adaptative et un paramètre d’effort, réglé sur « moyen » par défaut. Un niveau d’effort supérieur peut modifier la consommation de tokens, donc le coût final.

Anthropic indique également que le tokenizer de Haiku 5.5 compte environ 30 % de tokens supplémentaires pour un même texte par rapport à celui de Claude Haiku 4.5. Cette différence porte sur le comptage des tokens ; son effet sur une facture dépend des volumes réellement consommés.