Anthropic anunció Claude Haiku 5.5 el 7 de octubre de 2026. El modelo, que incorpora un ajuste de esfuerzo, tiene tarifas estándar de API en USD que dependen de la longitud del prompt: hasta 100.000 tokens se aplican los precios más bajos; por encima de ese umbral, las tarifas por millón de tokens son cinco veces mayores en las categorías publicadas.

Anthropic lanza Haiku 5.5 con esfuerzo ajustable

Claude Haiku 5.5 es el primer modelo de la clase Haiku que, según Anthropic, permite ajustar el esfuerzo. La empresa orienta el modelo a trabajos de gran volumen y sensibles al coste, como resumir, clasificar, compactar información, consultar bases de datos y realizar tareas de subagente.

En una API, los tokens son las unidades de texto que se procesan y se facturan. Por eso, además de la tarifa por millón, importa cuántos tokens de entrada y salida genera cada tarea.

Las tarifas de la API cambian al superar los 100.000 tokens

Vídeo sobre los tramos de precio y el consumo de tokens (en inglés)

La documentación de precios de Anthropic expresa estas tarifas estándar en dólares estadounidenses por millón de tokens. El tramo inferior corresponde a prompts de hasta 100.000 tokens; el superior, a los que superan esa cifra.

CargoPrompt de hasta 100.000 tokens (USD por millón de tokens)Prompt de más de 100.000 tokens (USD por millón de tokens)
Tokens de entrada0,100,50
Tokens de salida0,502,50
Lectura de caché0,010,05
Escritura en caché (5 minutos)0,1250,625
Escritura en caché (1 hora)0,201,00

Las tarifas de cada categoría de la tabla se multiplican por cinco en el tramo superior. Las lecturas y escrituras de caché tienen cargos propios; no se facturan como tokens de entrada o salida ordinarios.

El vídeo aborda los dos tramos de precios y el consumo de tokens asociado al esfuerzo. Está en inglés.

Qué significa el ahorro medio estimado por Anthropic

Anthropic calcula que Claude Haiku 5.5 cuesta alrededor de un 75 % menos de ejecutar, de media, que Claude Haiku 4.5. La empresa también indica reducciones del 90 % en las tarifas por token para prompts de hasta 100.000 tokens y del 50 % para los que superan ese umbral. Son cifras distintas: la estimación media se refiere al coste de uso, mientras que los porcentajes del 90 % y el 50 % describen tarifas por token.

Anthropic añade que el nuevo tokenizador genera ligeramente más tokens por tarea que el de Claude Haiku 4.5. El coste de una tarea, por tanto, depende del volumen facturado y de las categorías de uso —incluida la caché—, además de las tarifas unitarias.

Esfuerzo, contexto y usos previstos

El ajuste de esfuerzo es una opción del modelo, no un precio independiente en la tarifa publicada. Anthropic propone Haiku 5.5 para tareas repetitivas o de alto volumen, como resúmenes y consultas puntuales; también describe su uso como subagente junto a un modelo más grande.

La documentación del modelo especifica una ventana de contexto de un millón de tokens y una salida estándar máxima de 128.000 tokens. La ventana de contexto y el límite que separa los dos tramos de precio son cifras diferentes.

El identificador de API es claude-haiku-5-5. Para conocer el modelo anterior de la familia, puedes leer la cobertura de NeoTeo sobre Claude Sonnet 5.5.