Claude Haiku 5.5 (claude-haiku-5-5, lanzado el 7 de octubre de 2026) cuesta un 90% menos que Haiku 4.5 para prompts de hasta 100K tokens ($0.10/$0.50 por millón de tokens de entrada/salida frente a $1/$5), tiene una ventana de contexto de 1M de tokens en lugar de 200K, y obtiene puntuaciones mucho más altas en todos los benchmarks de lanzamiento que listan ambos. El inconveniente: cinco formas de solicitud que funcionaban en 4.5 ahora devuelven un 400, y varios cambios más alteran las respuestas y los costos sin error.
A continuación: una tabla comparativa, cada cambio disruptivo con JSON de antes/después, los cambios silenciosos y un plan de prueba para Apidog. Para la hoja de especificaciones completa, lee qué es Claude Haiku 5.5. Si aún ejecutas el modelo antiguo, nuestra guía de la API de Claude Haiku 4.5 lo cubre.
Haiku 4.5 vs Haiku 5.5 de un vistazo
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| ID de Modelo (API de Claude) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Contexto / salida máxima | 200K / 64K | 1M / 128K |
| Entrada / salida por MTok | $1 / $5 | $0.10 / $0.50 para prompts de hasta 100K tokens; $0.50 / $2.50 por encima |
| Lectura de caché / escritura de 5m por MTok | $0.10 / $1.25 | $0.01 / $0.125 hasta 100K; $0.05 / $0.625 por encima |
| Entrada / salida por lotes por MTok | $0.50 / $2.50 | $0.05 / $0.25 hasta 100K; $0.25 / $1.25 por encima |
| Pensamiento | budget_tokens manual |
Solo adaptativo, activado por defecto |
| Niveles de esfuerzo | Ninguno | bajo, medio (por defecto), alto, xalto, máximo |
| Prompt mínimo cacheable | 4,096 tokens | 512 tokens |
| Tokenizador | Antiguo | Aproximadamente un 30% más de tokens para el mismo texto |
| Parámetros de muestreo no predeterminados, prellenado | Aceptados | Error 400 |
| Nivel de Prioridad | Soportado | No soportado |
| Estado | Activo, retiro no antes del 15 de octubre de 2026 | Activo, retiro no antes del 7 de octubre de 2027 |
Haiku 4.5 no está obsoleto. La página de modelos obsoletos lo lista como Activo sin fecha de obsolescencia, por lo que puedes migrar según tu propio cronograma. Los límites de tasa son los mismos en ambos.
Los cinco cambios disruptivos
Cada uno devuelve un 400 en Haiku 5.5 para un cuerpo que funciona en 4.5. La guía de migración de Haiku 5.5 los lista todos.
1. Pensamiento manual con budget_tokens
Haiku 5.5 solo ejecuta pensamiento adaptativo. Un presupuesto fijo es rechazado.
// Antes (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// Después (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
El esfuerzo es ahora la palanca: donde 4.5 usaba un presupuesto pequeño, elige un esfuerzo menor. Aún puedes enviar thinking: {"type": "disabled"}, pero solo con un esfuerzo high o inferior; con xhigh o max también es un 400.
2. Parámetros de muestreo
Elimina temperature, top_p y top_k. Los únicos valores aceptados son temperature: 1 y top_p: 0.99. Cualquier otro valor es un 400, incluyendo top_p: 1, cualquier top_k, y enviar temperature y top_p juntos.
// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
// Después (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
Si utilizabas una temperatura baja para una salida consistente, traslada esa intención al prompt.
3. Relleno previo del asistente
Un turno final del asistente para que el modelo continúe es rechazado, incluso con el pensamiento desactivado. Termina messages con un turno de usuario.
// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// Después (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
] }
Para formatos estrictos, la guía de migración apunta a salidas estructuradas, o a una herramienta con campos enumerados para la clasificación.
4. Uso del equipo: computer_20250124 a computer_toolset_20260801
En la API de Claude y Google Cloud, Haiku 5.5 soporta el uso del equipo solo a través del nuevo conjunto de herramientas. Elimina la cabecera beta computer-use-2025-01-24, y elimina fine-grained-tool-streaming-2025-05-14 si la envías, porque es un 400 junto con un conjunto de herramientas.
// Antes (Haiku 4.5, cabecera anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
// Después (Haiku 5.5, sin cabecera beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
Tu bucle de agente también cambia: despacha en el name y toolset_name de cada bloque tool_use en lugar de input.action, y repite toolset_name en los resultados. Haiku 5.5 también obtiene la herramienta de uso del navegador (browser_toolset_20260801), que Haiku 4.5 no soporta. Consulta uso del ordenador en Claude Code para una visión más amplia.
5. Editar turnos anteriores antes de un bloque de pensamiento
Un bloque de pensamiento de Haiku 5.5 solo permanece válido mientras todo lo enviado antes de él no cambie. Cambiar system, tools o un mensaje anterior y reenviar el bloque, y obtendrás un 400. Haiku 4.5 nunca ejecutó esta comprobación. Aquí, el turno 1 envió "system": "You are a billing agent." y el turno 2 lo edita.
// Antes: sistema editado + bloque de pensamiento reproducido = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412." }
] }
// Después: turnos anteriores sin cambios, nueva instrucción añadida
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412. Be brief." }
] }
En cuentas creadas antes del 31 de agosto de 2026, 00:00 UTC, el error aparece solo en solicitudes que establecen thinking.block_binding.prefix_mismatch_behavior.
Cambios silenciosos que no generarán un error
- Campo de pensamiento vacío por defecto. Cada bloque
thinkingregresa con un campothinkingvacío y solo unasignature. Haiku 4.5 devolvía un pensamiento resumido. Configurathinking: {"type": "adaptive", "display": "summarized"}si lo registras o lo muestras. - Las respuestas pueden empezar con pensamiento. El pensamiento adaptativo está activado incluso cuando no lo configuras, así que selecciona los bloques de contenido por
type, no por índice. - Aproximadamente un 30% más de tokens. El nuevo tokenizador cuenta el mismo texto como aproximadamente un 30% más de tokens. Vuelve a contar los prompts, y recuerda que los tokens de pensamiento cuentan para
max_tokens, por lo que un límite pequeño puede detenerse constop_reason: "max_tokens"antes de cualquier texto. tool_choiceforzado omite el pensamiento.anyo una herramienta con nombre sigue funcionando, pero la respuesta comienza con la llamada a la herramienta y sin bloquethinking. Usatool_choice: {"type": "auto"}e indica al modelo cuándo llamar a la herramienta si quieres que razone primero.- Nuevas denegaciones, sin alternativa. Haiku 5.5 ejecuta clasificadores de seguridad (
cyber,frontier_llm,bio,general_harms) que pueden devolverstop_reason: "refusal". No hay alternativa del lado del servidor, y un reintento suele denegar de nuevo. - El Nivel de Prioridad ha desaparecido. Si tienes un compromiso de Nivel de Prioridad en Haiku 4.5, planifica la capacidad por separado.
- Los bloques de pensamiento están ligados a la cuenta. Funcionan solo en la cuenta que los produjo o en una vinculada. Reproducir conversaciones almacenadas a través de otra cuenta pierde ese razonamiento.
- El almacenamiento en caché más económico comienza antes. El prompt mínimo cacheable se reduce de 4,096 a 512 tokens, por lo que los prompts de sistema cortos que nunca se almacenaron en caché en 4.5 ahora sí lo hacen.
Lo que mejoró
Estos son números reportados por Anthropic con Haiku 5.5 a máximo esfuerzo; Artificial Analysis ejecutó GDPval-AA y AA-Briefcase de forma independiente.
| Benchmark | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, subconjunto offline | 15.7% | 72.4% |
| Examen Final de la Humanidad, con herramientas | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multilingüe | 67.4% | 83.7% |
| Cartografía, sin herramientas | 6.4% | 46.4% |
La ejecución de Terminal-Bench de Haiku 4.5 utilizó un presupuesto de pensamiento fijo de 63,999 tokens. Con el esfuerzo medium predeterminado, Haiku 5.5 obtuvo 1277 en GDPval-AA, aún muy por encima de 4.5. Box reportó puntuaciones 11 puntos más altas que Haiku 4.5 con aproximadamente la mitad de latencia. Las tablas completas están en benchmarks de Claude Haiku 5.5.
Anthropic todavía posiciona a Sonnet 5.5 y Opus 5.5 como mejores opciones para codificación agéntica compleja. Haiku 5.5 se enfoca en clasificación, extracción, resumen, compactación, subagentes y uso del navegador.
En cuanto al costo, Anthropic dice que Haiku 5.5 cuesta alrededor de un 75% menos en promedio. Esa cifra combina precios un 90% más bajos hasta 100K tokens y un 50% más bajos por encima, y ya compensa los tokens adicionales del nuevo tokenizador. El prompt del sistema de uso de herramientas también se redujo, de 496 a 286 tokens con la opción de herramienta auto. Ejemplos prácticos están en precios de Claude Haiku 5.5.
Prueba la migración en Apidog
En Apidog, crea un proyecto con tres solicitudes guardadas a https://api.anthropic.com/v1/messages:

- Línea de base: tu cuerpo actual de Haiku 4.5. Afirma el estado 200.
- Cuerpo antiguo, modelo nuevo: cambia solo
modelaclaude-haiku-5-5. Afirma el estado 400. Mantén una copia por cada cambio disruptivo que encuentres. - Migrado: el cuerpo corregido. Afirma el estado 200, una
stop_reasonque no searefusalomax_tokens, y un bloque de texto encontrado portype.
Almacena ANTHROPIC_API_KEY como variable de entorno y referénciala como {{ANTHROPIC_API_KEY}} en el encabezado x-api-key, con anthropic-version: 2023-06-01. Compara usage.input_tokens entre las solicitudes de línea de base y migrada para ver el cambio del tokenizador en tus propios prompts. Guarda el conjunto como un escenario de prueba, y un compañero de equipo que reintroduzca temperature fallará la ejecución en lugar de la producción. Los conceptos básicos de las solicitudes están en cómo usar la API de Claude Haiku 5.5.
Si trabajas en Claude Code, /claude-api migrate this project to claude-haiku-5-5 aplica el intercambio de ID de modelo y las correcciones de parámetros, luego te da una lista de verificación. Ten en cuenta que el alias haiku se resuelve a Haiku 5.5 solo en la API de Anthropic; consulta Claude Haiku 5.5 en Claude Code.
Preguntas frecuentes
¿Está obsoleto Claude Haiku 4.5? No. Está listado como Activo sin fecha de obsolescencia, y su retiro no será antes del 15 de octubre de 2026.
¿Por qué mi solicitud de Haiku 4.5 devuelve un 400 en Haiku 5.5? Verifica si hay budget_tokens, temperature/top_p/top_k, un prellenado de asistente, computer_20250124, o ediciones a turnos anteriores antes de un bloque de pensamiento. Esos son los cinco cambios disruptivos.
¿Es Haiku 5.5 más barato que Haiku 4.5 para prompts largos? Sí. Por encima de 100K tokens cuesta $0.50/$2.50 por millón, la mitad de los $1/$5 de Haiku 4.5. Haiku 4.5 no puede procesar prompts de más de 200K en absoluto.
¿Debería cambiar todo a Haiku 5.5? Para trabajos de clasificación, extracción y subagentes, pruébalo primero y luego migra. Compáralo con su rival más cercano en Haiku 5.5 vs GPT-6 Luna.
Siguiente paso
Guarda tu solicitud de Haiku 4.5 junto a su gemela de Haiku 5.5, confirma el 400, corrígelo y mueve el tráfico una vez que la solicitud migrada pase. Descarga Apidog para construir ese par de pruebas.
