Claude Haiku 5.5 es el modelo actual más pequeño y rápido de Anthropic, lanzado el 7 de octubre de 2026, con el ID de API claude-haiku-5-5. Cuesta $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida para prompts de hasta 100K tokens, y $0.50/$2.50 para prompts de más de 100K. En su publicación de lanzamiento, Anthropic dice que cuesta "alrededor de un 75% menos de ejecutar" que Haiku 4.5 en promedio, y lo llama "nuestro modelo más rápido hasta la fecha". También es el primer Haiku con una configuración de esfuerzo y cuenta con una ventana de contexto de 1M de tokens.
A continuación: especificaciones, el precio de dos niveles, cambios respecto a Haiku 4.5, benchmarks, dónde ejecutarlo y quién debería cambiar, con enlaces a guías más profundas como el desglose de precios de Haiku 5.5. Para llamar al modelo mientras lee, Apidog puede enviar la solicitud de Mensajes, mantener su clave en una variable de entorno y mostrar la respuesta junto con su uso de tokens.
Especificaciones de Claude Haiku 5.5 de un vistazo
| Especificación | Claude Haiku 5.5 |
|---|---|
| Fecha de lanzamiento | 7 de octubre de 2026 |
| ID del modelo (Claude API, Google Cloud, Microsoft Foundry, Claude Platform en AWS) | claude-haiku-5-5 (ID fijo, sin sufijo de fecha) |
| ID del modelo (Amazon Bedrock) | anthropic.claude-haiku-5-5 |
| Ventana de contexto | 1M de tokens (Haiku 4.5: 200K) |
| Salida máxima | 128K (Haiku 4.5: 64K); 300K en la API Batch con el encabezado beta output-300k-2026-03-24 |
| Pensamiento | Solo adaptativo |
| Niveles de esfuerzo | bajo, medio (predeterminado), alto, muy alto, máx |
| Fecha límite de conocimiento | Junio de 2026 |
| Precio por MTok, prompts de hasta 100K tokens | $0.10 entrada, $0.50 salida |
| Precio por MTok, prompts de más de 100K tokens | $0.50 entrada, $2.50 salida |
| Retiro | No antes del 7 de octubre de 2027 |
Dónde se posiciona Haiku 5.5 en la línea de productos de Claude
| Modelo | Entrada / salida por MTok | Esfuerzo predeterminado | Latencia |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | alto | Más lento |
| Claude Opus 5.5 | $4 / $20 | medio | Moderado |
| Claude Sonnet 5.5 | $2 / $10 | alto | Rápido |
| Claude Haiku 5.5 | $0.10 / $0.50 para prompts de hasta 100K tokens | medio | Más rápido |
Los cuatro comparten una ventana de contexto de 1M, una salida máxima de 128K y una fecha de corte de conocimiento de junio de 2026. Anthropic construyó Haiku 5.5 "para tareas de alto volumen y sensibles a la latencia, como clasificación, extracción y enrutamiento", además de resúmenes, soporte en vivo, uso del navegador y trabajo de subagente bajo Opus 5.5 o Sonnet 5.5.
La afirmación de velocidad tiene una nota a pie de página: el más rápido "a la velocidad estándar de cada modelo", pero más lento que Opus en Modo Rápido. Anthropic no publica cifras de tokens por segundo.
Precios de Claude Haiku 5.5
El precio depende de la longitud del prompt. Un prompt de más de 100,000 tokens paga la tarifa más alta.

Fuente: Precios de la API de Claude.
La cifra "alrededor de un 75% menos" es un promedio: 90% más barato que Haiku 4.5 para prompts de hasta 100K tokens, 50% más barato por encima, con el 90% de las solicitudes de Haiku 4.5 por debajo del umbral. Ya se ha tenido en cuenta el nuevo tokenizador, que produce aproximadamente un 30% más de tokens para el mismo texto.
La inferencia solo en EE. UU. (inference_geo) cuesta 1.1 veces en cada categoría de token. El prompt mínimo almacenable en caché se reduce a 512 tokens, desde los 4,096 de Haiku 4.5.
Por debajo de 100K tokens, el precio de lista coincide exactamente con GPT-6 Luna ($0.10 entrada, $0.50 salida, $0.01 lectura de caché, $0.125 escritura de caché). Los umbrales difieren: el recargo de Luna comienza por encima de 272K tokens de entrada. La comparación de Haiku 5.5 vs GPT-6 Luna explora esa brecha, y la guía de precios tiene ejemplos de costos calculados.
Qué cambió de Haiku 4.5
La ventana de contexto crece cinco veces, la salida máxima se duplica y se obtiene control de esfuerzo por primera vez. La guía de migración advierte que el código escrito para Haiku 4.5 puede fallar. Cinco cambios devuelven un error 400:
- Presupuestos de pensamiento manuales.
thinking: {"type": "enabled", "budget_tokens": N}falla. Use{"type": "adaptive"}conoutput_config.effort. - Parámetros de muestreo. Elimine
temperature,top_pytop_k. Los valores no predeterminados detemperatureotop_pfallan, al igual que cualquiertop_ko el envío simultáneo detemperatureytop_p. - Relleno previo del asistente. Rechazado, incluso con el pensamiento desactivado.
- Herramienta antigua de uso de computadora. En la API de Claude y Google Cloud, use
computer_toolset_20260801;computer_20250124falla. - Historial editado. Cambiar
system,toolso mensajes anteriores antes de un bloque de pensamiento devuelto falla. Mantenga las conversaciones solo de agregar.
Otros cambios no producirán un error, pero alterarán sus resultados:
- Visualización del pensamiento. Los bloques de pensamiento regresan vacíos por defecto, con solo una firma. Establezca
"display": "summarized"para leerlos. - Recuento de tokens. Aproximadamente un 30% más de tokens para el mismo texto;
max_tokenstambién cubre el pensamiento. - Uso forzado de herramientas.
tool_choicedeanyo una herramienta nombrada aún funciona, pero la respuesta no tiene un bloque de pensamiento. - Rechazos. Los clasificadores de seguridad pueden devolver
stop_reason: "refusal", sin un respaldo del lado del servidor. - Nivel de prioridad. No es compatible con Haiku 5.5.
El pensamiento se puede deshabilitar en la API con un esfuerzo alto o inferior; con muy alto y máx devuelve un 400. Haiku 4.5 no está obsoleto: todavía se lista como activo. La guía Haiku 5.5 vs Haiku 4.5 tiene JSON de antes/después para cada corrección.
Benchmarks de Claude Haiku 5.5
Las puntuaciones de Haiku 5.5 se obtienen con el máximo esfuerzo, en su mayoría promediadas en cinco pruebas. Artificial Analysis ejecutó GDPval-AA y AA-Briefcase, Cognition ejecutó FrontierCode, y Anthropic calificó Chartography (un benchmark de Surge AI) con su propia implementación.

Lea tres celdas con cuidado. FrontierCode compara Haiku en esfuerzo máximo con Sonnet 5.5 en muy alto; en esfuerzo máximo, Sonnet obtuvo un 46.2%, por debajo del 46.4% de Haiku. Anthropic ejecutó la puntuación OSWorld de Luna a través de la API de OpenAI, mientras que la puntuación Terminal-Bench de Luna proviene de la clasificación pública (Codex CLI). Y con el esfuerzo predeterminado medio, Haiku 5.5 obtuvo 1277 en GDPval-AA y 1372 en AA-Briefcase.
Anthropic afirma que Sonnet 5.5 y Opus 5.5 "siguen siendo mejores opciones para tareas de codificación agéntica complejas". Ninguna clasificación independiente tenía un resultado de Haiku 5.5 a fecha del 8 de octubre de 2026; Cursor reporta un 48.4% en su propio CursorBench en esfuerzo máximo. La inmersión profunda en los benchmarks tiene puntuaciones y costos por nivel de esfuerzo.
Dónde puedes usar Claude Haiku 5.5
| Plataforma | Acceso | Notas |
|---|---|---|
| API de Claude | claude-haiku-5-5 |
Pago por token |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Facturado a través de AWS Marketplace |
| Google Cloud, Microsoft Foundry, Claude Platform en AWS | claude-haiku-5-5 |
Mismo ID que la API de Claude |
| Claude.ai (web, iOS, Android) | Selector de modelo | Los usuarios Free, Pro, Max, Team y Enterprise pueden seleccionarlo |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293 o posterior; planes de pago |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
Desde $0.10 / $0.50 |
| Cursor | claude-haiku-5-5 |
Grupo de Otros Modelos |
A 8 de octubre de 2026, no estaba en OpenRouter ni anunciado para GitHub Copilot.
El acceso al chat en el plan Gratuito no es una clave API, y la API es de pago por uso más allá del pequeño crédito gratuito que Anthropic ofrece a los nuevos usuarios para pruebas. Los planes Max y Team ahora incluyen créditos API mensuales ($100 en Max 5x, $200 en Max 20x, hasta $500 acumulados en Team), que no cubren Claude Code. La guía de acceso gratuito enumera lo que es y no es gratuito.
En Claude Code, el alias haiku significa Haiku 5.5 solo en la API de Anthropic; en otros lugares, todavía significa Haiku 4.5. Consulte Haiku 5.5 en Claude Code para configuraciones de subagentes.
Quién debería cambiar a Haiku 5.5
- Si usas Haiku 4.5: cambia, después de corregir los cinco cambios que rompen la compatibilidad. Haiku 5.5 supera a Haiku 4.5 en cada fila de la tabla de lanzamiento donde ambos tienen una puntuación, a un precio de lista más bajo.
- Si usas Sonnet u Opus para trabajos simples y repetitivos: prueba Haiku 5.5 en clasificación, extracción, resúmenes y trabajos de subagente. Mantén el modelo más grande para tareas de codificación agéntica complejas.
- Si tus prompts a menudo superan los 100K tokens: calcula el precio de ambos niveles antes de comprometerte. Por encima del umbral, la entrada cuesta 5 veces más por token.
- Si realizas trabajos de seguridad: las salvaguardas cibernéticas de Haiku 5.5 aún bloquean las pruebas de penetración.
En la publicación de lanzamiento de Anthropic, Asana reporta una latencia más de un 30% menor en la finalización de tareas, y Box vio una puntuación 11 puntos superior a Haiku 4.5 con aproximadamente la mitad de la latencia. Estas son afirmaciones de clientes, no pruebas independientes.
La tarjeta del sistema señala que sobre-rechazó más que cualquier otro modelo en la auditoría automatizada de Anthropic, así que prueba las tasas de rechazo con tus propios prompts.
Envía tu primera solicitud Haiku 5.5
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
]
}'
Omita los parámetros de muestreo y el relleno previo. Lea los bloques de contenido por type, ya que la respuesta puede comenzar con un bloque de pensamiento.
En Apidog, importe el comando curl como una nueva solicitud y almacene la clave en una variable de entorno ANTHROPIC_API_KEY. Agregue aserciones de que stop_reason no es refusal o max_tokens. Luego, duplique la solicitud en medium y compare el usage para ver cuánto cuesta cada nivel de esfuerzo. La guía de la API de Haiku 5.5 cubre el almacenamiento en caché, procesamiento por lotes y streaming, y la guía de claves de API de Anthropic le ayudará si necesita una clave.
Preguntas frecuentes
¿Cuándo se lanzó Claude Haiku 5.5? El 7 de octubre de 2026, nueve días después de Sonnet 5.5.
¿Es Claude Haiku 5.5 gratuito? En la aplicación de chat Claude.ai, los usuarios Free pueden seleccionarlo. La API es de pago, aparte de pequeños créditos de prueba para nuevos usuarios. Consulte todas las rutas gratuitas.
¿Cuál es la ventana de contexto de Claude Haiku 5.5? 1M de tokens, con un máximo de 128K de salida en la API de Mensajes.
¿Se está retirando Haiku 4.5? Todavía no. Todavía se lista como activo, con su retiro no antes del 15 de octubre de 2026.
Siguiente paso
Elija un trabajo de alto volumen que realice hoy, como la clasificación de tickets o los resúmenes de documentos. Envíelo a claude-haiku-5-5 con esfuerzo bajo y medio, verifique la salida y compare el usage con su modelo actual. Descargue Apidog para mantener esas solicitudes y aserciones en un solo proyecto, luego use la guía de precios para convertir los recuentos de tokens en una factura mensual.
