Anthropic a annoncé Claude Haiku 5.5 le 7 octobre 2026. Ses tarifs API standard sont de 0,10 $ par million de tokens en entrée et 0,50 $ en sortie pour les prompts jusqu’à 100 000 tokens ; au-delà, ils passent à 0,50 $ et 2,50 $. Le modèle introduit aussi un réglage de l’effort dans la gamme Haiku.

Un effort réglable pour le premier modèle Haiku de ce type

Anthropic présente Claude Haiku 5.5 comme son premier modèle de classe Haiku doté d’un effort réglable. L’entreprise le destine notamment aux tâches à fort volume et sensibles au coût : résumés, classification, compactage de contexte, requêtes de base de données et tâches confiées à des sous-agents.

Les tarifs API changent au-delà de 100 000 tokens

Une présentation en anglais des tarifs par tranche et de l’usage des tokens selon l’effort

Les tarifs publiés par Anthropic sont exprimés en dollars américains par million de tokens. Un token est une unité de texte traitée et facturée par l’API. Anthropic applique une grille pour les prompts jusqu’à 100 000 tokens et une autre pour ceux qui dépassent ce seuil. La documentation tarifaire d’Anthropic détaille également les frais de cache.

FraisPrompt jusqu’à 100 000 tokens, par millionPrompt de plus de 100 000 tokens, par million
Tokens en entrée0,10 $0,50 $
Tokens en sortie0,50 $2,50 $
Lecture du cache0,01 $0,05 $
Écriture du cache, 5 minutes0,125 $0,625 $
Écriture du cache, 1 heure0,20 $1,00 $

Pour chacune de ces catégories, le tarif de la tranche supérieure est cinq fois celui de la tranche jusqu’à 100 000 tokens. L’API Batch bénéficie par ailleurs d’une réduction de 50 % sur les tarifs des tokens en entrée et en sortie. Sur Amazon Bedrock et Google Cloud, les tarifs sont fixés séparément et peuvent varier selon la région.

L’économie moyenne annoncée ne prédit pas une facture individuelle

Anthropic estime que Claude Haiku 5.5 coûte environ 75 % moins cher à utiliser en moyenne que Claude Haiku 4.5. Cette estimation de coût moyen ne désigne pas une baisse garantie pour chaque client. Les réductions de tarifs unitaires annoncées sont différentes : 90 % pour les prompts jusqu’à 100 000 tokens et 50 % au-delà. Anthropic indique aussi que son nouveau tokenizer utilise légèrement plus de tokens par tâche que celui de Claude Haiku 4.5.

Le montant d’une requête dépend donc du volume de tokens facturés et, pour les opérations concernées, de l’utilisation du cache. L’estimation moyenne et les tarifs par token décrivent deux mesures distinctes.

Les usages visés et les caractéristiques du modèle

Anthropic cite Claude Platform, Amazon Web Services, Google Cloud et Microsoft Azure parmi les plateformes proposant Haiku 5.5. Son identifiant API est claude-haiku-5-5. La documentation du modèle indique une fenêtre de contexte d’un million de tokens, une sortie maximale standard de 128 000 tokens, des entrées texte et image et une sortie textuelle.

Anthropic indique que Claude Sonnet 5.5 et Claude Opus 5.5 restent mieux adaptés aux tâches complexes de programmation agentique. Pour situer Haiku dans cette gamme, NeoTeo a déjà présenté Claude Sonnet 5.5.