Para usar Claude Haiku 5.5 en Claude Code, actualice a la v2.1.293 o posterior con claude update, luego inicie una sesión con claude --model claude-haiku-5-5 o ejecute /model claude-haiku-5-5 dentro de una. La mayor ventaja para la mayoría de las personas es ejecutarlo como subagente: coloque model: haiku en un archivo de subagente y deje que Sonnet 5.5 u Opus 5.5 le entregue las búsquedas, ejecuciones de prueba y resúmenes. Con una clave API, cuesta $0.10/$0.50 por millón de tokens de entrada/salida para prompts de hasta 100K tokens, y $0.50/$2.50 por encima de eso.
A continuación: configuración, la trampa del alias haiku, esfuerzo, archivos de subagentes, el paso de precio de 100K y cuándo Sonnet u Opus deberían liderar. Para el modelo en sí, lea qué es Claude Haiku 5.5. Si su código llama a APIs, Apidog tiene los escenarios de prueba que un subagente Haiku puede ejecutar por usted.

Claude Haiku 5.5 en Claude Code de un vistazo
| Configuración | Haiku 5.5 |
|---|---|
| Versión mínima | v2.1.293 (claude update) |
| ID de modelo | claude-haiku-5-5 |
Alias haiku |
Haiku 5.5 solo en la API de Anthropic |
| Contexto | 1M nativo en cada plan, sin sufijo [1m] |
| Auto-compactación | Aproximadamente 967K tokens por defecto |
| Esfuerzo predeterminado | medium (niveles de low a max) |
| Pensamiento | Siempre encendido; no se puede apagar |
| Precio de la API | $0.10/$0.50 para prompts de hasta 100K tokens; $0.50/$2.50 para más de 100K |
| Planes | Pro, Max, Team, Enterprise o una clave API; no Gratis |
Paso 1: actualizar Claude Code
Haiku 5.5 necesita Claude Code v2.1.293 o posterior. La entrada del registro de cambios lo llama “ahora el modelo Haiku predeterminado en la API de Anthropic.”
claude update
Claude Code no está en el plan Gratuito. Los usuarios gratuitos pueden seleccionar Haiku 5.5 en las aplicaciones de Claude.ai, pero Claude Code necesita Pro, Max, Team, Enterprise o una clave API de Anthropic. Según claude.com/pricing, Pro cuesta $17 al mes facturado anualmente o $20 mensualmente, y Max comienza en $100.
Paso 2: seleccionar Haiku 5.5 como su modelo principal
claude --model claude-haiku-5-5
Dentro de una sesión en ejecución, /model claude-haiku-5-5 hace lo mismo. Si su configuración model guardada es haiku, una sesión guardada en Haiku 4.5 se reanudará en Haiku 5.5.
El alias haiku solo significa Haiku 5.5 en la API de Anthropic
| Proveedor | haiku se resuelve a |
|---|---|
| API de Anthropic | Haiku 5.5 |
| Plataforma Claude en AWS | Haiku 4.5 |
| Amazon Bedrock, Plataforma de Agentes de Google Cloud | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
En cualquier proveedor de la nube, /model haiku y model: haiku en un archivo de subagente le darán Haiku 4.5. En su lugar, fije el ID completo: claude-haiku-5-5 en Google Cloud y Claude Platform en AWS, el nombre de su implementación en Foundry, y un ID de perfil de inferencia como us.anthropic.claude-haiku-5-5 en Amazon Bedrock. O apunte el alias a él con ANTHROPIC_DEFAULT_HAIKU_MODEL (Paso 5).
Paso 3: elegir un nivel de esfuerzo
Haiku 5.5 es el primer Haiku con control de esfuerzo: low, medium, high, xhigh y max, comenzando en medium en Claude Code.
claude --model claude-haiku-5-5 --effort high
En una sesión, /effort low guarda un nivel para el modelo actual. La guía de prompting de Anthropic sugiere low para tareas de herramientas cortas y solicitudes de gran volumen, medium para la mayoría del trabajo y high para tareas de agente más largas. Guarde xhigh y max para trabajos donde sus evaluaciones muestren una ganancia.
El pensamiento permanece activado. No puede desactivarlo en Haiku 5.5 en Claude Code; alwaysThinkingEnabled: false y MAX_THINKING_TOKENS=0 no tienen efecto. (La API de Mensajes sin procesar puede deshabilitarlo en high o inferior). Baje el esfuerzo cuando desee menos tokens de pensamiento.
Paso 4: ejecutar Haiku 5.5 como subagente
Anthropic dice que Haiku 5.5 “se combina bien con Opus 5.5 y Sonnet 5.5 como subagente en tareas de codificación”. Los subagentes son archivos Markdown con un frontmatter YAML en .claude/agents/ (proyecto) o ~/.claude/agents/ (todos los proyectos). Solo name y description son obligatorios, y la documentación de subagentes acepta sonnet, opus, haiku, fable, un ID de modelo completo, o inherit para model. Nuestra guía de subagentes cubre los alcances y las herramientas.
Reemplazar Explore con un explorador económico
El subagente Explore incorporado se ejecuta en el modelo de la conversación principal, no en Haiku. En una sesión de Opus 5.5, cada búsqueda de Explore se ejecuta en Opus. Un subagente de usuario o proyecto llamado Explore anula el incorporado y mantiene su propio model:
---
name: Explore
description: Fast read-only codebase search. Use to find files, symbols and call sites without editing anything.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Busca en la base de código e informa lo que encuentras. Devuelve las rutas de archivo con los números de línea y un breve resumen de cada coincidencia. Nunca edites archivos.
Guárdelo como .claude/agents/Explore.md. Ejecute /tasks mientras funciona para confirmar el modelo. En un proveedor de la nube, cambie haiku por el ID completo del Paso 2.
Forzar a cada subagente a usar Haiku
Para ejecutar cada subagente en Haiku, incluido Explore, configure ambas variables en el bloque env de un archivo de configuración:
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
Solo CLAUDE_CODE_SUBAGENT_MODEL es un valor predeterminado: el campo model propio de un subagente sigue prevaleciendo y Explore no se mueve.
Paso 5: dirigir el trabajo en segundo plano a Haiku 5.5
ANTHROPIC_DEFAULT_HAIKU_MODEL establece “el modelo a usar para haiku, o funcionalidad en segundo plano,” como resumir sesiones pasadas para claude --resume. El anterior ANTHROPIC_SMALL_FAST_MODEL está obsoleto, según la referencia de variables de entorno; reemplácelo si su perfil de shell aún lo configura.
En la API de Anthropic no necesita configurar nada. En Google Cloud, las tareas en segundo plano se establecen por defecto en Sonnet; en Foundry, en el modelo primario; en Bedrock, en Sonnet o en el modelo primario. Una vez que Haiku 5.5 esté habilitado en su cuenta, fíjelo:
# Plataforma de Agentes de Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (ID de perfil de inferencia)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
El paso de precio de 100K en sesiones largas
El precio de Haiku 5.5 depende de la longitud del prompt, y Claude Code envía la conversación como prompt en cada turno. Una vez que el contexto de una sesión supera los 100K tokens, cada solicitud se factura a $0.50/$2.50 en lugar de $0.10/$0.50, cinco veces la tarifa de prompt corto. La documentación no indica si los tokens en caché cuentan para esa línea, así que presuma que sí.
La autocondensación no te salvará: Haiku 5.5 se condensa por defecto en unos 967K tokens, por lo que una sesión puede superar con creces el paso de precio. Dos hábitos ayudan cuando pagas por token:
- Compactar antes.
/autocompact 100kestablece la ventana más baja que acepta Claude Code, por lo que la sesión se compacta cerca del límite en lugar de cerca de 1M. - Impulsar el trabajo voluminoso a los subagentes. Un subagente tiene su propio contexto, por lo que los registros de prueba y los resultados de búsqueda quedan fuera de la conversación principal.
Incluso por encima de los 100K, $0.50/$2.50 es un cuarto de los $2/$10 de Sonnet 5.5. En un plan de pago, las sesiones utilizan límites de uso en su lugar, y Anthropic no ha publicado cómo Haiku 5.5 cuenta contra ellos. Nuestro desglose de precios de Haiku 5.5 explica la aritmética.
Suscriptores Max y Team: los nuevos créditos API mensuales ($100 en Max 5x, $200 en Max 20x, hasta $500 agrupados en Team) no cubren Claude Code interactivo, según la documentación de créditos API de Anthropic.
Cuándo mantener a Sonnet 5.5 o Opus 5.5 como líder
Anthropic dice que Sonnet 5.5 y Opus 5.5 “siguen siendo mejores opciones para tareas de codificación complejas basadas en agentes”. En Terminal-Bench 4.0, ejecutado por Anthropic en Claude Code con máximo esfuerzo, Haiku 5.5 obtuvo un 39.2% frente al 70.6% de Sonnet 5.5. Los gráficos de lanzamiento añaden el costo por intento:
| Esfuerzo | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20.3% a $0.68 | 28.8% a $0.68 |
high |
24.8% a $1.04 | 43% a $1.46 |
max |
39.2% a $2.64 | 70.6% a $10.44 |
En medium, ambos cuestan aproximadamente lo mismo por intento y Sonnet puntúa más alto. El precio por token de Haiku no se traslada a trabajos largos de shell, así que no lo convierta en el líder para sesiones de codificación difíciles.
El uso del ordenador cuenta una historia diferente. En OSWorld 2.1, Haiku 5.5 en medium obtuvo un 53.3% con un costo de $0.13 por intento, mientras que Sonnet 5.5 en low obtuvo un 57.9% con un costo de $0.68. Nuestro desglose de benchmarks de Haiku 5.5 tiene todas las filas, y la guía de Claude Code de Sonnet 5.5 cubre el lado del modelo principal.
Una división práctica: Sonnet 5.5 u Opus 5.5 como modelo principal, Haiku 5.5 para Explore, ejecutores de pruebas, lectores de registros y recuperadores de documentos.
Ejemplo: un subagente Haiku que ejecuta sus pruebas Apidog
Las ejecuciones de pruebas son verbosas y repetitivas, una buena opción para Haiku. La CLI de Apidog ejecuta sus escenarios de prueba de Apidog guardados desde la terminal, por lo que un subagente puede ejecutarlos y devolver un informe corto mientras el contexto del modelo principal permanece limpio.
---
name: api-test-runner
description: Runs the project's Apidog test scenarios with the Apidog CLI after an API endpoint changes, then reports pass and fail counts with the failing requests.
tools: Bash, Read
model: haiku
effort: low
---
Ejecute el comando de prueba de la CLI de Apidog documentado en el README de este repositorio para el
escenario que cubre el endpoint modificado. Informe los recuentos de aprobación y fallo.
Para cada fallo, proporcione el nombre de la solicitud, el resultado esperado y el resultado
real. No edite código. No reintente una ejecución fallida más de una vez.
La configuración de la CLI, incluyendo la autenticación y el comando de ejecución, se encuentra en Apidog CLI en Claude Code. Descargue Apidog para construir los escenarios que ejecuta el subagente.
Migrar una aplicación de Haiku 4.5
Si su aplicación llama a Haiku 4.5 a través de la API, Claude Code puede iniciar la migración:
/claude-api migrate this project to claude-haiku-5-5
Espere cambios importantes: el pensamiento manual budget_tokens, temperature o top_p no predeterminados, cualquier top_k y el prellenado del asistente devuelven un 400 en Haiku 5.5. La guía Haiku 5.5 vs Haiku 4.5 enumera cada corrección. Después de la edición, guarde la solicitud antigua y la nueva como un par en Apidog, almacene ANTHROPIC_API_KEY como una variable de entorno y aserte en stop_reason y usage, de modo que una nueva detención por refusal o un salto en los tokens falle una prueba en lugar de llegar a producción.
Preguntas frecuentes
¿Es Haiku 5.5 el modelo predeterminado en Claude Code? No. Es el modelo Haiku predeterminado en la API de Anthropic, lo que significa que el alias haiku apunta a él. Selecciónelo como su modelo principal con --model o /model.
¿Puedo usar Haiku 5.5 en Claude Code en el plan Gratuito? No. Claude Code requiere un plan de pago o una clave API. Los usuarios gratuitos pueden elegir Haiku 5.5 en las aplicaciones de Claude.ai; vea cómo usar Claude Haiku 5.5 gratis.
¿Por qué model: haiku me da Haiku 4.5? Está en Bedrock, Google Cloud, Foundry o Claude Platform en AWS, o en una versión anterior a la v2.1.293. Fije el ID completo o configure ANTHROPIC_DEFAULT_HAIKU_MODEL.
¿Puedo desactivar el pensamiento para ahorrar tokens? No en Claude Code. Baje el esfuerzo en su lugar; low es la configuración más económica.
Su próximo paso
Ejecute claude update, agregue la anulación de Haiku Explore y mantenga su modelo principal actual durante una semana. Luego, agregue el subagente ejecutor de pruebas si su proyecto tiene APIs. Para llamar al modelo desde su propio código, comience con la guía de API de Haiku 5.5. Apidog es gratuito para empezar y le ofrece a ese subagente pruebas reales para ejecutar.
