Claude Haiku 5.5 cuesta $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida para prompts de hasta 100K tokens. Un prompt de más de 100,000 tokens paga precios más altos: $0.50 de entrada y $2.50 de salida. Las lecturas de caché comienzan en $0.01, la API Batch reduce a la mitad cada tarifa, y Anthropic dice que el modelo cuesta "alrededor de un 75% menos de ejecutar" que Haiku 4.5 en promedio.
Esta guía cubre cada partida, la matemática detrás de ese 75%, tres ejemplos resueltos (uno superando los 100K), el costo por nivel de esfuerzo, y cómo Haiku 5.5 se compara con Haiku 4.5, GPT-6 Luna y Sonnet 5.5. ¿Nuevo en el modelo? Comienza con qué es Claude Haiku 5.5. Para verificar los números en tu propio tráfico, envía solicitudes desde Apidog y lee el bloque usage de cada respuesta.
Tabla de precios de la API de Claude Haiku 5.5
Precios por millón de tokens (MTok), de los documentos de precios de Anthropic:
| Concepto | Prompts de hasta 100K tokens | Prompts de más de 100K tokens |
|---|---|---|
| Entrada | $0.10 | $0.50 |
| Salida | $0.50 | $2.50 |
| Escritura en caché de 5 minutos | $0.125 | $0.625 |
| Escritura en caché de 1 hora | $0.20 | $1.00 |
| Lectura de caché (aciertos y actualizaciones) | $0.01 | $0.05 |
| Entrada por lotes | $0.05 | $0.25 |
| Salida por lotes | $0.25 | $1.25 |
La documentación lo expresa claramente: "un prompt de más de 100,000 tokens paga precios más altos". Otros modelos de Claude a partir de la versión 4.6 facturan la ventana completa de 1M a una tarifa; Haiku 5.5 es la excepción. Ten en cuenta también:
- Inferencia solo en EE. UU. El enrutamiento solo en EE. UU. a través de
inference_geocuesta 1.1x en cada categoría de tokens en la API de Claude y en la Plataforma Claude en AWS: $0.11 de entrada y $0.55 de salida por debajo de 100K. - Un nuevo tokenizador. El mismo texto produce aproximadamente un 30% más de tokens que en Haiku 4.5.
- Menor sobrecarga de herramientas. El prompt del sistema de uso de herramientas es de 286 tokens (auto/none), frente a 496 en Haiku 4.5.
- Sin nivel de prioridad y sin modo rápido.
De dónde viene "alrededor de un 75% menos"
Haiku 5.5 tiene un precio un 90% más bajo que Haiku 4.5 hasta 100,000 tokens y un 50% más bajo por encima; el 90% de las solicitudes de Haiku 4.5 caían por debajo de 100K; y la cifra compensa el nuevo tokenizador. Una reconstrucción aproximada:
- Ponderación por conteo de solicitudes: 0.9 × 90% + 0.1 × 50% = 86% menos.
- Añadir aproximadamente un 30% más de tokens: el 14% restante del costo se convierte en 14% × 1.3 = 18.2%, por lo que el ahorro se reduce a aproximadamente el 82%.

La cifra de Anthropic es aún menor. No publican la ponderación, y los prompts largos probablemente conllevan una mayor parte del gasto que del conteo de solicitudes. Trata el 75% como un promedio; tus datos de usage son la respuesta real.
Costo por intento en cada nivel de esfuerzo
Haiku 5.5 es el primer Haiku con niveles de esfuerzo (de low a max; medium es el valor predeterminado de la API), y el esfuerzo mueve tu factura más que la lista de precios. Estas cifras provienen de los gráficos por esfuerzo de la publicación de lanzamiento. Anthropic ejecutó OSWorld y Terminal-Bench; Artificial Analysis ejecutó GDPval-AA:
| Esfuerzo | OSWorld 2.1 (puntuación, $/intento) | GDPval-AA v2.1 (Elo, $/tarea) | Terminal-Bench 4.0 (puntuación, $/intento) |
|---|---|---|---|
| bajo | 42.0%, $0.0695 | 1125, $0.0117 | 12.7%, $0.424 |
| medio | 53.3%, $0.1257 | 1277, $0.0304 | 20.3%, $0.6798 |
| alto | 61.3%, $0.1827 | 1420, $0.0894 | 24.8%, $1.0372 |
| muy alto | 67.6%, $0.2792 | 1513, $0.2673 | 31.5%, $1.7545 |
| máximo | 72.4%, $0.6111 | 1620, $0.8659 | 39.2%, $2.6433 |
Lo que destaca:
- El máximo cuesta 4.9 veces más que el medio en OSWorld ($0.6111 ÷ $0.1257) y 28.5 veces más que el medio en GDPval-AA ($0.86593 ÷ $0.03042).
- Las puntuaciones de la tabla de lanzamiento son de esfuerzo máximo. Con el valor predeterminado
medium, GDPval-AA es 1277, no 1620. - Para la codificación con agentes, consulta Sonnet. En Terminal-Bench, Sonnet 5.5 en
low(con lecturas de caché de $0.10) obtuvo un 20% por $0.6205, frente a Haiku 5.5 enmediumcon un 20.3% por $0.6798. Anthropic dice que Sonnet y Opus "siguen siendo mejores opciones para tareas de codificación complejas basadas en agentes". Nuestro desglose de benchmarks tiene todas las filas.
Cómo se compara Haiku 5.5 en precio
| Modelo | Entrada / salida por MTok | Lectura de caché | Escritura en caché de 5m | Regla de prompt largo |
|---|---|---|---|---|
| Claude Haiku 5.5 | $0.10 / $0.50 hasta 100K | $0.01 | $0.125 | Más de 100K: $0.50 / $2.50 |
| GPT-6 Luna | $0.10 / $0.50 | $0.01 | $0.125 | Más de 272K de entrada: 2x entrada y caché, 1.5x salida ($0.20 / $0.75) |
| Claude Haiku 4.5 | $1 / $5 | $0.10 | $1.25 | Una tarifa (contexto de 200K) |
| Claude Sonnet 5.5 | $2 / $10 | $0.10 | $2.50 | Una tarifa en 1M |
GPT-6 Luna iguala a Haiku 5.5 hasta 100K; el umbral difiere. Según la página del modelo de OpenAI, el recargo de Luna comienza por encima de 272K y se aplica "para la solicitud completa". La llamada del Ejemplo 3 se mantiene en la tarifa base de Luna: (150,000 × $0.10 + 2,000 × $0.50) ÷ 1,000,000 = $0.016, frente a $0.08 en Haiku 5.5. Los tokenizadores también difieren: un comentarista de Hacker News estimó que 100K tokens de Claude equivalen a unos 60-65K tokens de GPT. En el gráfico OSWorld de Anthropic, Haiku 5.5 en medium (53.3%, $0.1257) superó a Luna en max (48.9%, $0.205). Más en Claude Haiku 5.5 vs GPT-6 Luna.
Sonnet 5.5 redujo las lecturas de caché de $0.20 a $0.10 el mismo día, aproximadamente un 20% más barato en la mayoría de los trabajos de agentes según Anthropic. Nuestra guía de precios de Sonnet 5.5 es anterior a este recorte.
Haiku 4.5 no está obsoleto; Haiku 5.5 vs Haiku 4.5 lista los cambios importantes a corregir primero.
Créditos de API y planes para consumidores
Créditos de API Max y Team. Max 5x obtiene $100 al mes en créditos de la Plataforma Claude, Max 20x $200, y Team $20 por puesto Estándar y $100 por puesto Premium, acumulados y limitados a $500. Gratuito, Pro y Enterprise no son elegibles. Según los documentos de créditos de API, cubren la API de Claude, no Claude Code ni las nubes, y no se acumulan. A $0.10 por MTok, $100 compran mil millones de tokens de entrada, o aproximadamente 220,000 solicitudes del Ejemplo 1 ($100 ÷ $0.000455).
Planes para consumidores (claude.com/pricing): Los usuarios de Free ($0), Pro, Max, Team y Enterprise pueden seleccionar Haiku 5.5 en Claude.ai en la web, iOS y Android. Pro cuesta $17/mes con facturación anual o $20 mensuales; Max comienza en $100/mes. Free no tiene Claude Code, y un plan de chat no puede ejecutar un script o un trabajo de CI. Cómo usar Claude Haiku 5.5 gratis cubre el resto.
Nubes. Bedrock, Google Cloud y Foundry facturan Haiku 5.5 a través de sus propias páginas de precios.
Rastrea el costo por solicitud en Apidog
Cada respuesta de Messages devuelve un objeto usage, que es suficiente para calcular el precio de una llamada en Apidog:
- Almacena tu clave como una variable de entorno
ANTHROPIC_API_KEY. - Guarda esta solicitud una vez por nivel de esfuerzo (
low,medium,high) con el mismo prompt:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- Añade un post-procesador que elija el nivel y calcule el precio de la llamada. Trata
input_tokenscomo la longitud del prompt, lo que se mantiene sin caché:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
- Ejecuta los tres y compara los tokens de salida y el costo lado a lado.
La comprobación de rechazo es importante porque los clasificadores de seguridad de Haiku 5.5 no tienen un respaldo del lado del servidor. El tutorial completo está en cómo usar la API de Claude Haiku 5.5.
Preguntas frecuentes
¿Cuánto cuesta Claude Haiku 5.5 por millón de tokens? $0.10 de entrada y $0.50 de salida para prompts de hasta 100K tokens; $0.50 y $2.50 por encima.
¿Es Haiku 5.5 más barato que Haiku 4.5? Sí: un 90% más barato por token hasta 100K, un 50% por encima, y alrededor de un 75% en promedio según Anthropic.
¿Haiku 5.5 tiene el mismo precio que GPT-6 Luna? Hasta 100K, sí. Por encima de eso, Haiku 5.5 sube 5 veces; Luna se mantiene estable hasta 272K. Nuestra descripción general de GPT-6 Luna tiene los detalles.
¿Los créditos del plan Max funcionan en Claude Code? No. Cubren la API de la Plataforma Claude, no Claude Code. Consulta Claude Haiku 5.5 en Claude Code para el acceso al plan allí.
Siguiente paso: calcula el precio de tu propia carga de trabajo
Toma tus tres formas de solicitud más comunes, verifica cuántas superan los 100K y ejecuta cada una en low y medium. Multiplica los números de usage por la tabla anterior para obtener tu ahorro real. Descarga Apidog para mantener esas solicitudes y el script de costos en un solo proyecto.
