Claude Haiku 5.5 Precios

Precios de Claude Haiku 5.5: $0.10/$0.50 por millón de tokens para prompts de hasta 100K, $0.50/$2.50 por encima de 100K. Ejemplos de costos de caché, procesamiento por lotes y calculados.

INEZA Felin-Michel

INEZA Felin-Michel

8 October 2026

Claude Haiku 5.5 Precios

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Claude Haiku 5.5 cuesta $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida para prompts de hasta 100K tokens. Un prompt de más de 100,000 tokens paga precios más altos: $0.50 de entrada y $2.50 de salida. Las lecturas de caché comienzan en $0.01, la API Batch reduce a la mitad cada tarifa, y Anthropic dice que el modelo cuesta "alrededor de un 75% menos de ejecutar" que Haiku 4.5 en promedio.

Esta guía cubre cada partida, la matemática detrás de ese 75%, tres ejemplos resueltos (uno superando los 100K), el costo por nivel de esfuerzo, y cómo Haiku 5.5 se compara con Haiku 4.5, GPT-6 Luna y Sonnet 5.5. ¿Nuevo en el modelo? Comienza con qué es Claude Haiku 5.5. Para verificar los números en tu propio tráfico, envía solicitudes desde Apidog y lee el bloque usage de cada respuesta.

Tabla de precios de la API de Claude Haiku 5.5

Precios por millón de tokens (MTok), de los documentos de precios de Anthropic:

Concepto Prompts de hasta 100K tokens Prompts de más de 100K tokens
Entrada $0.10 $0.50
Salida $0.50 $2.50
Escritura en caché de 5 minutos $0.125 $0.625
Escritura en caché de 1 hora $0.20 $1.00
Lectura de caché (aciertos y actualizaciones) $0.01 $0.05
Entrada por lotes $0.05 $0.25
Salida por lotes $0.25 $1.25

La documentación lo expresa claramente: "un prompt de más de 100,000 tokens paga precios más altos". Otros modelos de Claude a partir de la versión 4.6 facturan la ventana completa de 1M a una tarifa; Haiku 5.5 es la excepción. Ten en cuenta también:

De dónde viene "alrededor de un 75% menos"

Haiku 5.5 tiene un precio un 90% más bajo que Haiku 4.5 hasta 100,000 tokens y un 50% más bajo por encima; el 90% de las solicitudes de Haiku 4.5 caían por debajo de 100K; y la cifra compensa el nuevo tokenizador. Una reconstrucción aproximada:

  1. Ponderación por conteo de solicitudes: 0.9 × 90% + 0.1 × 50% = 86% menos.
  2. Añadir aproximadamente un 30% más de tokens: el 14% restante del costo se convierte en 14% × 1.3 = 18.2%, por lo que el ahorro se reduce a aproximadamente el 82%.

La cifra de Anthropic es aún menor. No publican la ponderación, y los prompts largos probablemente conllevan una mayor parte del gasto que del conteo de solicitudes. Trata el 75% como un promedio; tus datos de usage son la respuesta real.

Costo por intento en cada nivel de esfuerzo

Haiku 5.5 es el primer Haiku con niveles de esfuerzo (de low a max; medium es el valor predeterminado de la API), y el esfuerzo mueve tu factura más que la lista de precios. Estas cifras provienen de los gráficos por esfuerzo de la publicación de lanzamiento. Anthropic ejecutó OSWorld y Terminal-Bench; Artificial Analysis ejecutó GDPval-AA:

Esfuerzo OSWorld 2.1 (puntuación, $/intento) GDPval-AA v2.1 (Elo, $/tarea) Terminal-Bench 4.0 (puntuación, $/intento)
bajo 42.0%, $0.0695 1125, $0.0117 12.7%, $0.424
medio 53.3%, $0.1257 1277, $0.0304 20.3%, $0.6798
alto 61.3%, $0.1827 1420, $0.0894 24.8%, $1.0372
muy alto 67.6%, $0.2792 1513, $0.2673 31.5%, $1.7545
máximo 72.4%, $0.6111 1620, $0.8659 39.2%, $2.6433

Lo que destaca:

Cómo se compara Haiku 5.5 en precio

Modelo Entrada / salida por MTok Lectura de caché Escritura en caché de 5m Regla de prompt largo
Claude Haiku 5.5 $0.10 / $0.50 hasta 100K $0.01 $0.125 Más de 100K: $0.50 / $2.50
GPT-6 Luna $0.10 / $0.50 $0.01 $0.125 Más de 272K de entrada: 2x entrada y caché, 1.5x salida ($0.20 / $0.75)
Claude Haiku 4.5 $1 / $5 $0.10 $1.25 Una tarifa (contexto de 200K)
Claude Sonnet 5.5 $2 / $10 $0.10 $2.50 Una tarifa en 1M

GPT-6 Luna iguala a Haiku 5.5 hasta 100K; el umbral difiere. Según la página del modelo de OpenAI, el recargo de Luna comienza por encima de 272K y se aplica "para la solicitud completa". La llamada del Ejemplo 3 se mantiene en la tarifa base de Luna: (150,000 × $0.10 + 2,000 × $0.50) ÷ 1,000,000 = $0.016, frente a $0.08 en Haiku 5.5. Los tokenizadores también difieren: un comentarista de Hacker News estimó que 100K tokens de Claude equivalen a unos 60-65K tokens de GPT. En el gráfico OSWorld de Anthropic, Haiku 5.5 en medium (53.3%, $0.1257) superó a Luna en max (48.9%, $0.205). Más en Claude Haiku 5.5 vs GPT-6 Luna.

Sonnet 5.5 redujo las lecturas de caché de $0.20 a $0.10 el mismo día, aproximadamente un 20% más barato en la mayoría de los trabajos de agentes según Anthropic. Nuestra guía de precios de Sonnet 5.5 es anterior a este recorte.

Haiku 4.5 no está obsoleto; Haiku 5.5 vs Haiku 4.5 lista los cambios importantes a corregir primero.

Créditos de API y planes para consumidores

Créditos de API Max y Team. Max 5x obtiene $100 al mes en créditos de la Plataforma Claude, Max 20x $200, y Team $20 por puesto Estándar y $100 por puesto Premium, acumulados y limitados a $500. Gratuito, Pro y Enterprise no son elegibles. Según los documentos de créditos de API, cubren la API de Claude, no Claude Code ni las nubes, y no se acumulan. A $0.10 por MTok, $100 compran mil millones de tokens de entrada, o aproximadamente 220,000 solicitudes del Ejemplo 1 ($100 ÷ $0.000455).

Planes para consumidores (claude.com/pricing): Los usuarios de Free ($0), Pro, Max, Team y Enterprise pueden seleccionar Haiku 5.5 en Claude.ai en la web, iOS y Android. Pro cuesta $17/mes con facturación anual o $20 mensuales; Max comienza en $100/mes. Free no tiene Claude Code, y un plan de chat no puede ejecutar un script o un trabajo de CI. Cómo usar Claude Haiku 5.5 gratis cubre el resto.

Nubes. Bedrock, Google Cloud y Foundry facturan Haiku 5.5 a través de sus propias páginas de precios.

Rastrea el costo por solicitud en Apidog

Cada respuesta de Messages devuelve un objeto usage, que es suficiente para calcular el precio de una llamada en Apidog:

  1. Almacena tu clave como una variable de entorno ANTHROPIC_API_KEY.
  2. Guarda esta solicitud una vez por nivel de esfuerzo (low, medium, high) con el mismo prompt:
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. Añade un post-procesador que elija el nivel y calcule el precio de la llamada. Trata input_tokens como la longitud del prompt, lo que se mantiene sin caché:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
  1. Ejecuta los tres y compara los tokens de salida y el costo lado a lado.

La comprobación de rechazo es importante porque los clasificadores de seguridad de Haiku 5.5 no tienen un respaldo del lado del servidor. El tutorial completo está en cómo usar la API de Claude Haiku 5.5.

Preguntas frecuentes

¿Cuánto cuesta Claude Haiku 5.5 por millón de tokens? $0.10 de entrada y $0.50 de salida para prompts de hasta 100K tokens; $0.50 y $2.50 por encima.

¿Es Haiku 5.5 más barato que Haiku 4.5? Sí: un 90% más barato por token hasta 100K, un 50% por encima, y alrededor de un 75% en promedio según Anthropic.

¿Haiku 5.5 tiene el mismo precio que GPT-6 Luna? Hasta 100K, sí. Por encima de eso, Haiku 5.5 sube 5 veces; Luna se mantiene estable hasta 272K. Nuestra descripción general de GPT-6 Luna tiene los detalles.

¿Los créditos del plan Max funcionan en Claude Code? No. Cubren la API de la Plataforma Claude, no Claude Code. Consulta Claude Haiku 5.5 en Claude Code para el acceso al plan allí.

Siguiente paso: calcula el precio de tu propia carga de trabajo

Toma tus tres formas de solicitud más comunes, verifica cuántas superan los 100K y ejecuta cada una en low y medium. Multiplica los números de usage por la tabla anterior para obtener tu ahorro real. Descarga Apidog para mantener esas solicitudes y el script de costos en un solo proyecto.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs