Claude Haiku 5.5 vs GPT-6 Luna

Haiku 5.5 vs. GPT-6 Luna: mismo precio de $0.10/$0.50 por debajo de 100K tokens, diferentes niveles para prompts largos, los benchmarks de Anthropic y datos de costos por esfuerzo.

Medy Evrard

8 October 2026

Claude Haiku 5.5 vs GPT-6 Luna

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Claude Haiku 5.5 y GPT-6 Luna comparten un precio de lista: $0.10/$0.50 por millón de tokens de entrada/salida para prompts de Haiku de hasta 100K tokens, con $0.01 por lecturas de caché y $0.125 por escrituras de caché en ambos. La diferencia está en dónde termina ese precio. Haiku 5.5 pasa a $0.50/$2.50 por encima de los 100K tokens; Luna mantiene su tarifa base hasta los 272K tokens de entrada, luego cobra 2x por entrada y 1.5x por salida. En la tabla de lanzamiento de Anthropic, Haiku 5.5 obtiene una puntuación más alta en cada fila compartida. En los propios gráficos de costos de Anthropic, Luna es más barata por tarea en cada nivel de esfuerzo de GDPval-AA y en cuatro de cinco en OSWorld; en OSWorld medio, Haiku 5.5 es marginalmente más barato.

botón

A continuación: precio, especificaciones, los benchmarks compartidos y quién los ejecutó, curvas de costo por esfuerzo y enrutamiento por carga de trabajo. Para cada modelo por separado, consulta qué es Claude Haiku 5.5 y qué es GPT-6 Luna. La última sección envía el mismo prompt a ambos en Apidog.

Precio lado a lado

Por 1M de tokens Claude Haiku 5.5 GPT-6 Luna
Entrada, nivel base $0.10 (prompts de hasta 100K tokens) $0.10 (hasta 272K tokens de entrada)
Salida, nivel base $0.50 $0.50
Lectura de caché, nivel base $0.01 $0.01
Escritura de caché, nivel base $0.125 (5 minutos) $0.125
Nivel superior, entrada / salida $0.50 / $2.50 (más de 100K) $0.20 / $0.75 (más de 272K)
Nivel superior, lectura / escritura de caché $0.05 / $0.625 2x las tarifas de caché
Proceso por lotes $0.05 / $0.25 hasta 100K; $0.25 / $1.25 por encima 50% de las tarifas estándar (lotes y flexibles)

Fuentes: documentación de precios de Anthropic y la página del modelo GPT-6 Luna de OpenAI. OpenAI recalcula el precio de "la solicitud completa" por encima de los 272K. Anthropic dice que "un prompt de más de 100.000 tokens paga precios más altos", cobrado por solicitud según la longitud del prompt.

Por debajo de 100K tokens, las facturas coinciden línea por línea. Entre 100K y 272K, Haiku 5.5 es 5 veces más caro que Luna en entrada y salida. Por encima de 272K, ambos están en su nivel superior, y el de Luna sigue siendo más barato.

Dos ejemplos, contados en los tokens de cada proveedor:

Anthropic dice que los prompts de hasta 100K tokens representaron alrededor del 90% de las solicitudes de Haiku 4.5. Si tu tráfico se parece a eso, la mayoría de tus llamadas cuestan lo mismo en cualquiera de los modelos. Más cálculos en precios de Claude Haiku 5.5.

Los tokenizadores mueven el umbral

Un token en un modelo no es un token en el otro. El tokenizador actualizado de Haiku 5.5 produce aproximadamente un 30% más de tokens que Haiku 4.5 para el mismo texto, según Anthropic. En el hilo de lanzamiento de Hacker News, un comentarista estimó que "los 100K tokens de Claude moderno son aproximadamente ~60-65K tokens de GPT moderno". Esto es una estimación de la comunidad, no una cifra del proveedor. Si se mantiene, la línea de 100K de Haiku llega antes en términos de texto de lo que sugieren los números brutos. Cuenta tus propios prompts en ambas APIs y lee cada objeto usage.

Especificaciones

Claude Haiku 5.5 GPT-6 Luna
ID del modelo API claude-haiku-5-5 gpt-6-luna
Ventana de contexto 1M de tokens 1,050,000 tokens
Salida máxima 128K tokens (300K en lotes con un encabezado beta) 128,000 tokens
Fecha de corte de conocimiento Junio de 2026 18 de mayo de 2026
Niveles de esfuerzo bajo, medio (predeterminado), alto, muy alto, máximo ninguno, bajo, medio (predeterminado), alto, muy alto, máximo
Pensamiento desactivado thinking: {"type": "disabled"} en esfuerzo alto o inferior esfuerzo de razonamiento none
Acceso gratuito al chat Los usuarios gratuitos de Claude.ai pueden seleccionarlo Usuarios gratuitos y Go en la aplicación de escritorio ChatGPT

Ambos se configuran por defecto en medium. En Haiku 5.5 el parámetro es output_config.effort; en Luna es reasoning.effort. Ninguna de las rutas de chat gratuitas es una clave API, por lo que no puede impulsar un script, un trabajo de CI o un agente. Consulta Claude Haiku 5.5 gratis y GPT-6 Luna gratis.

Una diferencia de caché importa en los bucles. En Haiku 5.5, cambiar el effort de nivel superior entre solicitudes invalida la caché del prompt. OpenAI dice que cambiar el esfuerzo de razonamiento ya no rompe la caché en los modelos GPT-6 (almacenamiento en caché de prompts de GPT-6).

Benchmarks: la tabla de Anthropic y quién ejecutó cada celda de Luna

Cada número a continuación proviene de la publicación de lanzamiento de Anthropic y su tarjeta de sistema. Anthropic compiló la tabla, pero diferentes partes ejecutaron diferentes filas. Los resultados de Haiku 5.5 son con esfuerzo máximo, en su mayoría promediados sobre cinco intentos.

Benchmark Haiku 5.5 GPT-6 Luna Cómo se obtuvo la celda de Luna
GDPval-AA v2.1 (Elo) 1620 1437 Ejecutado de forma independiente por Artificial Analysis
AA-Briefcase v1.1 (Elo) 1578 1336 Ejecutado de forma independiente por Artificial Analysis
OSWorld 2.1, subconjunto sin conexión 72.4% 48.9% Ejecutado por Anthropic en las mismas 82 tareas a través de la API de OpenAI
Terminal-Bench 4.0 39.2% 16.4% Tabla de clasificación pública, Codex CLI con esfuerzo máximo
FrontierCode 1.1 (Principal) 46.4% 42.4% Ejecutado por Cognition (Claude en Claude Code, GPT en Codex)
Cartografía, sin herramientas 46.4% 29.1% Según lo informado públicamente por Surge AI

Las filas comparten un nombre de benchmark, no un arnés: Terminal-Bench enfrenta a Haiku 5.5 en Claude Code contra Luna en el CLI de Codex. OSWorld es lo más cercano a controlado, ya que Anthropic ejecutó ambos modelos en las mismas tareas, pero sigue siendo un proveedor ejecutando el modelo de un rival.

Aún no existe una comparación directa independiente. A partir del 8 de octubre de 2026, Artificial Analysis no tiene una página para Haiku 5.5, y no encontramos ningún resultado de Haiku 5.5 en Vals, LMArena, SWE-bench o Aider. La tabla de clasificación de AA de ese día enumera a GPT-6 Luna (máx.) con un Índice de Inteligencia de 38 y 129 tokens de salida por segundo. Resultados completos de Haiku 5.5: benchmarks de Claude Haiku 5.5.

Costo por intento en cada nivel de esfuerzo

La tabla de lanzamiento muestra cada modelo en su máximo. La página de lanzamiento de Anthropic también traza cada nivel de esfuerzo frente al costo, con Luna en dos gráficos.

OSWorld 2.1 (subconjunto sin conexión), puntuación de crédito parcial / costo por intento:

Esfuerzo Haiku 5.5 GPT-6 Luna
Bajo 42.0% / $0.0695 19.2% / $0.038
Medio 53.3% / $0.1257 37.5% / $0.1261
Alto 61.3% / $0.1827 42.3% / $0.1435
Muy alto 67.6% / $0.2792 44.8% / $0.1672
Máximo 72.4% / $0.6111 48.9% / $0.205

GDPval-AA v2.1, Elo / costo por tarea:

Esfuerzo Haiku 5.5 GPT-6 Luna
Bajo 1125 / $0.01167 1036 / $0.0038
Medio 1277 / $0.03042 1262 / $0.02
Alto 1420 / $0.08938 1344 / $0.03
Muy alto 1513 / $0.26725 1364 / $0.05
Máximo 1620 / $0.86593 1437 / $0.09

Luna cuesta menos en cada nivel de esfuerzo en GDPval-AA y en cuatro de cinco en OSWorld (en medio, Haiku 5.5 es $0.0004 más barato). En gasto equivalente, Haiku 5.5 lidera en OSWorld; GDPval-AA está cerca. Haiku 5.5 puntúa más alto en todos los niveles. Compara con un gasto equivalente:

Así que, en uso de computadora, Haiku 5.5 compra más puntuación por dólar en la ejecución de Anthropic. En el trabajo de conocimiento, los dos están cerca con el mismo gasto, y el precio base más bajo de Luna gana cuando "suficientemente bueno" es el objetivo.

Enrutamiento: qué modelo para qué carga de trabajo

Anthropic posiciona a Haiku 5.5 para "tareas de alcance limitado" y dice que Sonnet 5.5 y Opus 5.5 "siguen siendo mejores opciones para tareas de codificación agénticas complejas". Ambos modelos aquí están construidos para volumen.

Carga de trabajo Empezar con Por qué
Clasificación, enrutamiento, extracción por debajo de 100K tokens Cualquiera; probar ambos Precio idéntico; elige por precisión para tus etiquetas
Preguntas y respuestas de documentos largos, de 100K a 272K tokens GPT-6 Luna La tarifa base se mantiene hasta 272K; Haiku 5.5 es 5x más caro por encima de 100K
Automatización de navegador y escritorio Claude Haiku 5.5 Mayor puntuación en OSWorld con un costo equivalente
Subagentes bajo Opus 5.5 o Sonnet 5.5 Claude Haiku 5.5 Frontmatter de Claude Code model: haiku (Haiku 5.5 en la API de Anthropic)
Menor costo por llamada GPT-6 Luna Costo base más bajo: $0.038 (OSWorld) y $0.0038 (GDPval-AA) en bajo
Redacción de trabajo de conocimiento con alto esfuerzo Cualquiera; probar ambos Dentro de 17 Elo con un gasto equivalente en GDPval-AA

Consulta Claude Haiku 5.5 en Claude Code para subagentes y GPT-6 Luna para cargas de trabajo de API de alto volumen para pipelines de alto QPS. ¿Vienes de Haiku 4.5? Haiku 5.5 vs Haiku 4.5 lista los cinco nuevos errores 400.

Prueba ambos lado a lado en Apidog

La comparación directa que lo decide se ejecuta con tus propios prompts. En Apidog, crea un proyecto con dos solicitudes y el mismo prompt:

  1. Almacena ANTHROPIC_API_KEY y tu clave de OpenAI como variables de entorno.
  2. Añade la solicitud de Haiku 5.5 a continuación, luego la solicitud de Luna con el mismo prompt y esfuerzo.
  3. Asegúrate de que el stop_reason de Haiku no sea "refusal" (no hay un respaldo del lado del servidor) y que el usage se mantenga dentro de tu presupuesto de tokens.
  4. Ejecuta ambos con esfuerzo bajo, medio y alto, y guarda cada respuesta para comparar tokens, latencia y salida.
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
    ]
  }'

Omite temperature, top_p y top_k: los valores no predeterminados devuelven un 400 en Haiku 5.5. Tutorial: cómo usar la API de Claude Haiku 5.5. Para conjuntos de evaluación, consulta prueba de aplicaciones LLM.

Preguntas frecuentes

¿Claude Haiku 5.5 y GPT-6 Luna tienen el mismo precio? Sí, para prompts de Haiku de hasta 100K tokens: $0.10/$0.50, $0.01 por lecturas de caché, $0.125 por escrituras de caché. Por encima de eso, Haiku 5.5 cuesta $0.50/$2.50 mientras que Luna se mantiene en la tarifa base hasta los 272K.

¿Qué modelo puntúa más alto? Haiku 5.5, en cada fila compartida de la tabla de lanzamiento de Anthropic. Anthropic compiló esa tabla; aún no existe una comparación directa independiente.

¿Cuál es más barato por tarea? Generalmente Luna: en cada nivel de esfuerzo en el gráfico GDPval-AA de Anthropic y en cuatro de cinco en OSWorld (en medio, Haiku 5.5 es $0.0004 más barato). Con un gasto equivalente, Haiku 5.5 lidera en OSWorld; GDPval-AA está cerca.

¿Es alguno de ellos gratuito? Solo en el chat: los usuarios gratuitos de Claude.ai pueden seleccionar Haiku 5.5, y los usuarios gratuitos y Go obtienen Luna en la aplicación de escritorio ChatGPT. Ninguno te da una clave API. Consulta Claude Haiku 5.5 gratis.

Elige por longitud del prompt, luego prueba

Revisa primero las longitudes de tus prompts. Por debajo de 100K tokens, el precio es un empate y la precisión decide, donde los números de Anthropic favorecen a Haiku 5.5. Entre 100K y 272K, el umbral de Luna ahorra dinero en cada llamada. Luego ejecuta ambos en solicitudes reales con dos o tres niveles de esfuerzo: descarga Apidog, coloca ambas solicitudes en un proyecto y deja que los números de usage decidan.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs