Claude Haiku 5.5 vs Haiku 4.5: Novedades y cambios incompatibles prioritarios a solucionar

Haiku 5.5 contra Haiku 4.5: 90% más barato hasta 100K tokens, 1M de contexto, y cinco cambios drásticos que devuelven errores 400. Soluciones JSON antes/después incluidas.

Medy Evrard

8 October 2026

Claude Haiku 5.5 vs Haiku 4.5: Novedades y cambios incompatibles prioritarios a solucionar

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Claude Haiku 5.5 (claude-haiku-5-5, lanzado el 7 de octubre de 2026) cuesta un 90% menos que Haiku 4.5 para prompts de hasta 100K tokens ($0.10/$0.50 por millón de tokens de entrada/salida frente a $1/$5), tiene una ventana de contexto de 1M de tokens en lugar de 200K, y obtiene puntuaciones mucho más altas en todos los benchmarks de lanzamiento que listan ambos. El inconveniente: cinco formas de solicitud que funcionaban en 4.5 ahora devuelven un 400, y varios cambios más alteran las respuestas y los costos sin error.

A continuación: una tabla comparativa, cada cambio disruptivo con JSON de antes/después, los cambios silenciosos y un plan de prueba para Apidog. Para la hoja de especificaciones completa, lee qué es Claude Haiku 5.5. Si aún ejecutas el modelo antiguo, nuestra guía de la API de Claude Haiku 4.5 lo cubre.

botón

Haiku 4.5 vs Haiku 5.5 de un vistazo

Claude Haiku 4.5 Claude Haiku 5.5
ID de Modelo (API de Claude) claude-haiku-4-5-20251001 claude-haiku-5-5
Contexto / salida máxima 200K / 64K 1M / 128K
Entrada / salida por MTok $1 / $5 $0.10 / $0.50 para prompts de hasta 100K tokens; $0.50 / $2.50 por encima
Lectura de caché / escritura de 5m por MTok $0.10 / $1.25 $0.01 / $0.125 hasta 100K; $0.05 / $0.625 por encima
Entrada / salida por lotes por MTok $0.50 / $2.50 $0.05 / $0.25 hasta 100K; $0.25 / $1.25 por encima
Pensamiento budget_tokens manual Solo adaptativo, activado por defecto
Niveles de esfuerzo Ninguno bajo, medio (por defecto), alto, xalto, máximo
Prompt mínimo cacheable 4,096 tokens 512 tokens
Tokenizador Antiguo Aproximadamente un 30% más de tokens para el mismo texto
Parámetros de muestreo no predeterminados, prellenado Aceptados Error 400
Nivel de Prioridad Soportado No soportado
Estado Activo, retiro no antes del 15 de octubre de 2026 Activo, retiro no antes del 7 de octubre de 2027

Haiku 4.5 no está obsoleto. La página de modelos obsoletos lo lista como Activo sin fecha de obsolescencia, por lo que puedes migrar según tu propio cronograma. Los límites de tasa son los mismos en ambos.

Los cinco cambios disruptivos

Cada uno devuelve un 400 en Haiku 5.5 para un cuerpo que funciona en 4.5. La guía de migración de Haiku 5.5 los lista todos.

1. Pensamiento manual con budget_tokens

Haiku 5.5 solo ejecuta pensamiento adaptativo. Un presupuesto fijo es rechazado.

// Antes (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// Después (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

El esfuerzo es ahora la palanca: donde 4.5 usaba un presupuesto pequeño, elige un esfuerzo menor. Aún puedes enviar thinking: {"type": "disabled"}, pero solo con un esfuerzo high o inferior; con xhigh o max también es un 400.

2. Parámetros de muestreo

Elimina temperature, top_p y top_k. Los únicos valores aceptados son temperature: 1 y top_p: 0.99. Cualquier otro valor es un 400, incluyendo top_p: 1, cualquier top_k, y enviar temperature y top_p juntos.

// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// Después (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

Si utilizabas una temperatura baja para una salida consistente, traslada esa intención al prompt.

3. Relleno previo del asistente

Un turno final del asistente para que el modelo continúe es rechazado, incluso con el pensamiento desactivado. Termina messages con un turno de usuario.

// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// Después (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

Para formatos estrictos, la guía de migración apunta a salidas estructuradas, o a una herramienta con campos enumerados para la clasificación.

4. Uso del equipo: computer_20250124 a computer_toolset_20260801

En la API de Claude y Google Cloud, Haiku 5.5 soporta el uso del equipo solo a través del nuevo conjunto de herramientas. Elimina la cabecera beta computer-use-2025-01-24, y elimina fine-grained-tool-streaming-2025-05-14 si la envías, porque es un 400 junto con un conjunto de herramientas.

// Antes (Haiku 4.5, cabecera anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// Después (Haiku 5.5, sin cabecera beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

Tu bucle de agente también cambia: despacha en el name y toolset_name de cada bloque tool_use en lugar de input.action, y repite toolset_name en los resultados. Haiku 5.5 también obtiene la herramienta de uso del navegador (browser_toolset_20260801), que Haiku 4.5 no soporta. Consulta uso del ordenador en Claude Code para una visión más amplia.

5. Editar turnos anteriores antes de un bloque de pensamiento

Un bloque de pensamiento de Haiku 5.5 solo permanece válido mientras todo lo enviado antes de él no cambie. Cambiar system, tools o un mensaje anterior y reenviar el bloque, y obtendrás un 400. Haiku 4.5 nunca ejecutó esta comprobación. Aquí, el turno 1 envió "system": "You are a billing agent." y el turno 2 lo edita.

// Antes: sistema editado + bloque de pensamiento reproducido = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// Después: turnos anteriores sin cambios, nueva instrucción añadida
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

En cuentas creadas antes del 31 de agosto de 2026, 00:00 UTC, el error aparece solo en solicitudes que establecen thinking.block_binding.prefix_mismatch_behavior.

Cambios silenciosos que no generarán un error

Lo que mejoró

Estos son números reportados por Anthropic con Haiku 5.5 a máximo esfuerzo; Artificial Analysis ejecutó GDPval-AA y AA-Briefcase de forma independiente.

Benchmark Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, subconjunto offline 15.7% 72.4%
Examen Final de la Humanidad, con herramientas 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Multilingüe 67.4% 83.7%
Cartografía, sin herramientas 6.4% 46.4%

La ejecución de Terminal-Bench de Haiku 4.5 utilizó un presupuesto de pensamiento fijo de 63,999 tokens. Con el esfuerzo medium predeterminado, Haiku 5.5 obtuvo 1277 en GDPval-AA, aún muy por encima de 4.5. Box reportó puntuaciones 11 puntos más altas que Haiku 4.5 con aproximadamente la mitad de latencia. Las tablas completas están en benchmarks de Claude Haiku 5.5.

Anthropic todavía posiciona a Sonnet 5.5 y Opus 5.5 como mejores opciones para codificación agéntica compleja. Haiku 5.5 se enfoca en clasificación, extracción, resumen, compactación, subagentes y uso del navegador.

En cuanto al costo, Anthropic dice que Haiku 5.5 cuesta alrededor de un 75% menos en promedio. Esa cifra combina precios un 90% más bajos hasta 100K tokens y un 50% más bajos por encima, y ya compensa los tokens adicionales del nuevo tokenizador. El prompt del sistema de uso de herramientas también se redujo, de 496 a 286 tokens con la opción de herramienta auto. Ejemplos prácticos están en precios de Claude Haiku 5.5.

Prueba la migración en Apidog

En Apidog, crea un proyecto con tres solicitudes guardadas a https://api.anthropic.com/v1/messages:

  1. Línea de base: tu cuerpo actual de Haiku 4.5. Afirma el estado 200.
  2. Cuerpo antiguo, modelo nuevo: cambia solo model a claude-haiku-5-5. Afirma el estado 400. Mantén una copia por cada cambio disruptivo que encuentres.
  3. Migrado: el cuerpo corregido. Afirma el estado 200, una stop_reason que no sea refusal o max_tokens, y un bloque de texto encontrado por type.

Almacena ANTHROPIC_API_KEY como variable de entorno y referénciala como {{ANTHROPIC_API_KEY}} en el encabezado x-api-key, con anthropic-version: 2023-06-01. Compara usage.input_tokens entre las solicitudes de línea de base y migrada para ver el cambio del tokenizador en tus propios prompts. Guarda el conjunto como un escenario de prueba, y un compañero de equipo que reintroduzca temperature fallará la ejecución en lugar de la producción. Los conceptos básicos de las solicitudes están en cómo usar la API de Claude Haiku 5.5.

Si trabajas en Claude Code, /claude-api migrate this project to claude-haiku-5-5 aplica el intercambio de ID de modelo y las correcciones de parámetros, luego te da una lista de verificación. Ten en cuenta que el alias haiku se resuelve a Haiku 5.5 solo en la API de Anthropic; consulta Claude Haiku 5.5 en Claude Code.

Preguntas frecuentes

¿Está obsoleto Claude Haiku 4.5? No. Está listado como Activo sin fecha de obsolescencia, y su retiro no será antes del 15 de octubre de 2026.

¿Por qué mi solicitud de Haiku 4.5 devuelve un 400 en Haiku 5.5? Verifica si hay budget_tokens, temperature/top_p/top_k, un prellenado de asistente, computer_20250124, o ediciones a turnos anteriores antes de un bloque de pensamiento. Esos son los cinco cambios disruptivos.

¿Es Haiku 5.5 más barato que Haiku 4.5 para prompts largos? Sí. Por encima de 100K tokens cuesta $0.50/$2.50 por millón, la mitad de los $1/$5 de Haiku 4.5. Haiku 4.5 no puede procesar prompts de más de 200K en absoluto.

¿Debería cambiar todo a Haiku 5.5? Para trabajos de clasificación, extracción y subagentes, pruébalo primero y luego migra. Compáralo con su rival más cercano en Haiku 5.5 vs GPT-6 Luna.

Siguiente paso

Guarda tu solicitud de Haiku 4.5 junto a su gemela de Haiku 5.5, confirma el 400, corrígelo y mueve el tráfico una vez que la solicitud migrada pase. Descarga Apidog para construir ese par de pruebas.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs