✨︎ Resumen (TL;DR):
- Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026 para resumir documentos y clasificar información.
- La API cobra 0.10 dólares por millón de tokens de entrada y 0.50 de salida hasta 100,000 tokens; después, 0.50 y 2.50.
- El esfuerzo ajustable permite priorizar velocidad o dedicar más trabajo, pero el tokenizador cuenta aproximadamente 30% más tokens para la misma entrada.
Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026 para tareas frecuentes como resumir documentos y clasificar información. El modelo ya está disponible mediante la API de Claude, Amazon Web Services, Google Cloud y Microsoft Azure; sus tarifas bajan frente a Haiku 4.5 y es el primer modelo de la familia Haiku con esfuerzo ajustable. Su nuevo tokenizador, sin embargo, cuenta aproximadamente 30% más tokens para una misma entrada y puede cambiar el tramo de precio.
Claude Haiku 5.5 es un modelo de IA que permite regular cuánto trabajo dedica a una respuesta. Anthropic usa claude-haiku-5-5 como identificador para desarrolladores.

La tarifa depende del tamaño de la solicitud
Según la ficha oficial, Haiku 5.5 cobra 0.10 dólares por millón de tokens de entrada y 0.50 dólares por millón de tokens de salida para solicitudes de hasta 100,000 tokens. Por encima de ese umbral, los precios suben a 0.50 y 2.50 dólares, respectivamente.
El tamaño de la entrada determina el tramo aplicado a los cargos de entrada y salida. Anthropic cobra la lectura de caché por separado.
Las tarifas de la API publicadas al 7 de octubre de 2026, en dólares por millón de tokens, son:
| Concepto | Haiku 4.5 | Haiku 5.5, entrada de hasta 100,000 tokens | Haiku 5.5, entrada de más de 100,000 tokens |
|---|---|---|---|
| Entrada | $1.00 | $0.10 | $0.50 |
| Salida | $5.00 | $0.50 | $2.50 |
| Lectura de caché | $0.10 | $0.01 | $0.05 |
Frente a Haiku 4.5, la reducción es de 90% para solicitudes de hasta 100,000 tokens y de 50% para las que superan ese tamaño. Anthropic calcula un ahorro promedio de alrededor de 75% al ejecutar Haiku 5.5, una estimación que combina las tarifas con el consumo de tokens por trabajo.
La empresa señala que 90% de las solicitudes a Haiku 4.5 quedaban en el tramo de hasta 100,000 tokens.
El conteo de tokens puede cambiar la factura
El tokenizador es el sistema que divide el texto en unidades de procesamiento. La documentación técnica advierte que el nuevo tokenizador de Haiku 5.5 cuenta aproximadamente 30% más tokens que Haiku 4.5 para una misma entrada. El incremento exacto depende del contenido.
Un ejemplo hipotético muestra el efecto. Una entrada de 80,000 tokens en Haiku 4.5 pasaría a unos 104,000 tokens si su conteo aumentara 30%. El documento mantendría el mismo contenido, pero Haiku 5.5 lo ubicaría en el tramo de más de 100,000 tokens.
En ese escenario, procesar la entrada costaría $0.052 con el nuevo modelo, frente a $0.08 con Haiku 4.5. El ahorro sería de 35% para ese componente. La API cobra por separado la salida y la lectura de caché.
El ejemplo muestra que el costo por documento depende del conteo actualizado, además de la tarifa por token.
Más contexto y control sobre el esfuerzo
Haiku 5.5 amplía su ventana de contexto de 200,000 a 1,000,000 tokens y su salida máxima de 64,000 a 128,000 tokens, según la documentación de Anthropic. La ventana de contexto es un límite de contenido que indica cuánto puede manejar el modelo en una solicitud. El umbral de precio sigue en 100,000 tokens.
El control effort admite los niveles low, medium, high, xhigh y max. medium es el valor predeterminado. La guía oficial explica que este ajuste afecta el razonamiento, el texto de respuesta y las llamadas a herramientas.
Reducir el esfuerzo favorece la velocidad y el ahorro; aumentarlo permite dedicar más trabajo a la tarea. En solicitudes largas para agentes, la documentación advierte que low puede hacer que el modelo omita una búsqueda, se detenga antes o se salte una comprobación. El ahorro depende de que el nivel elegido conserve la calidad necesaria para el trabajo.
Haiku ejecuta tareas acotadas junto a Opus 5.5
Amazon describe el uso de Haiku 5.5 junto a Opus 5.5 como una distribución de tareas. Opus planifica y toma las decisiones complejas, mientras Haiku ejecuta encargos acotados como clasificar, resumir o aplicar cambios pequeños al código.
Anthropic baja la lectura de caché de Sonnet 5.5
Anthropic redujo a la mitad el precio de lectura de caché de Sonnet 5.5, de $0.20 a $0.10 dólares por millón de tokens. La compañía estima que ese cambio baja alrededor de 20% el costo de la mayoría de sus tareas con agentes.
La rebaja actualiza el componente de caché de las tarifas anunciadas con el lanzamiento de Sonnet 5.5. Para Haiku 5.5, la entrada decide el tramo, el tokenizador cambia el conteo y effort regula el trabajo que el modelo dedica. La API de Claude, Amazon Web Services, Google Cloud y Microsoft Azure ya tienen disponible el modelo.
