Claude Haiku 5.5 y GPT-6 Luna comparten un precio de lista: $0.10/$0.50 por millón de tokens de entrada/salida para prompts de Haiku de hasta 100K tokens, con $0.01 por lecturas de caché y $0.125 por escrituras de caché en ambos. La diferencia está en dónde termina ese precio. Haiku 5.5 pasa a $0.50/$2.50 por encima de los 100K tokens; Luna mantiene su tarifa base hasta los 272K tokens de entrada, luego cobra 2x por entrada y 1.5x por salida. En la tabla de lanzamiento de Anthropic, Haiku 5.5 obtiene una puntuación más alta en cada fila compartida. En los propios gráficos de costos de Anthropic, Luna es más barata por tarea en cada nivel de esfuerzo de GDPval-AA y en cuatro de cinco en OSWorld; en OSWorld medio, Haiku 5.5 es marginalmente más barato.
A continuación: precio, especificaciones, los benchmarks compartidos y quién los ejecutó, curvas de costo por esfuerzo y enrutamiento por carga de trabajo. Para cada modelo por separado, consulta qué es Claude Haiku 5.5 y qué es GPT-6 Luna. La última sección envía el mismo prompt a ambos en Apidog.
Precio lado a lado
| Por 1M de tokens | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Entrada, nivel base | $0.10 (prompts de hasta 100K tokens) | $0.10 (hasta 272K tokens de entrada) |
| Salida, nivel base | $0.50 | $0.50 |
| Lectura de caché, nivel base | $0.01 | $0.01 |
| Escritura de caché, nivel base | $0.125 (5 minutos) | $0.125 |
| Nivel superior, entrada / salida | $0.50 / $2.50 (más de 100K) | $0.20 / $0.75 (más de 272K) |
| Nivel superior, lectura / escritura de caché | $0.05 / $0.625 | 2x las tarifas de caché |
| Proceso por lotes | $0.05 / $0.25 hasta 100K; $0.25 / $1.25 por encima | 50% de las tarifas estándar (lotes y flexibles) |
Fuentes: documentación de precios de Anthropic y la página del modelo GPT-6 Luna de OpenAI. OpenAI recalcula el precio de "la solicitud completa" por encima de los 272K. Anthropic dice que "un prompt de más de 100.000 tokens paga precios más altos", cobrado por solicitud según la longitud del prompt.
Por debajo de 100K tokens, las facturas coinciden línea por línea. Entre 100K y 272K, Haiku 5.5 es 5 veces más caro que Luna en entrada y salida. Por encima de 272K, ambos están en su nivel superior, y el de Luna sigue siendo más barato.
Dos ejemplos, contados en los tokens de cada proveedor:
- Prompt de 150K tokens, salida de 2K. Haiku 5.5: 0.15 × $0.50 + 0.002 × $2.50 = $0.080. Luna: 0.15 × $0.10 + 0.002 × $0.50 = $0.016.
- Prompt de 300K tokens, salida de 2K. Haiku 5.5: 0.30 × $0.50 + 0.002 × $2.50 = $0.155. Luna: 0.30 × $0.20 + 0.002 × $0.75 = $0.0615.
Anthropic dice que los prompts de hasta 100K tokens representaron alrededor del 90% de las solicitudes de Haiku 4.5. Si tu tráfico se parece a eso, la mayoría de tus llamadas cuestan lo mismo en cualquiera de los modelos. Más cálculos en precios de Claude Haiku 5.5.
Los tokenizadores mueven el umbral
Un token en un modelo no es un token en el otro. El tokenizador actualizado de Haiku 5.5 produce aproximadamente un 30% más de tokens que Haiku 4.5 para el mismo texto, según Anthropic. En el hilo de lanzamiento de Hacker News, un comentarista estimó que "los 100K tokens de Claude moderno son aproximadamente ~60-65K tokens de GPT moderno". Esto es una estimación de la comunidad, no una cifra del proveedor. Si se mantiene, la línea de 100K de Haiku llega antes en términos de texto de lo que sugieren los números brutos. Cuenta tus propios prompts en ambas APIs y lee cada objeto usage.
Especificaciones
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| ID del modelo API | claude-haiku-5-5 |
gpt-6-luna |
| Ventana de contexto | 1M de tokens | 1,050,000 tokens |
| Salida máxima | 128K tokens (300K en lotes con un encabezado beta) | 128,000 tokens |
| Fecha de corte de conocimiento | Junio de 2026 | 18 de mayo de 2026 |
| Niveles de esfuerzo | bajo, medio (predeterminado), alto, muy alto, máximo | ninguno, bajo, medio (predeterminado), alto, muy alto, máximo |
| Pensamiento desactivado | thinking: {"type": "disabled"} en esfuerzo alto o inferior |
esfuerzo de razonamiento none |
| Acceso gratuito al chat | Los usuarios gratuitos de Claude.ai pueden seleccionarlo | Usuarios gratuitos y Go en la aplicación de escritorio ChatGPT |
Ambos se configuran por defecto en medium. En Haiku 5.5 el parámetro es output_config.effort; en Luna es reasoning.effort. Ninguna de las rutas de chat gratuitas es una clave API, por lo que no puede impulsar un script, un trabajo de CI o un agente. Consulta Claude Haiku 5.5 gratis y GPT-6 Luna gratis.
Una diferencia de caché importa en los bucles. En Haiku 5.5, cambiar el effort de nivel superior entre solicitudes invalida la caché del prompt. OpenAI dice que cambiar el esfuerzo de razonamiento ya no rompe la caché en los modelos GPT-6 (almacenamiento en caché de prompts de GPT-6).
Benchmarks: la tabla de Anthropic y quién ejecutó cada celda de Luna
Cada número a continuación proviene de la publicación de lanzamiento de Anthropic y su tarjeta de sistema. Anthropic compiló la tabla, pero diferentes partes ejecutaron diferentes filas. Los resultados de Haiku 5.5 son con esfuerzo máximo, en su mayoría promediados sobre cinco intentos.
| Benchmark | Haiku 5.5 | GPT-6 Luna | Cómo se obtuvo la celda de Luna |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Ejecutado de forma independiente por Artificial Analysis |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Ejecutado de forma independiente por Artificial Analysis |
| OSWorld 2.1, subconjunto sin conexión | 72.4% | 48.9% | Ejecutado por Anthropic en las mismas 82 tareas a través de la API de OpenAI |
| Terminal-Bench 4.0 | 39.2% | 16.4% | Tabla de clasificación pública, Codex CLI con esfuerzo máximo |
| FrontierCode 1.1 (Principal) | 46.4% | 42.4% | Ejecutado por Cognition (Claude en Claude Code, GPT en Codex) |
| Cartografía, sin herramientas | 46.4% | 29.1% | Según lo informado públicamente por Surge AI |
Las filas comparten un nombre de benchmark, no un arnés: Terminal-Bench enfrenta a Haiku 5.5 en Claude Code contra Luna en el CLI de Codex. OSWorld es lo más cercano a controlado, ya que Anthropic ejecutó ambos modelos en las mismas tareas, pero sigue siendo un proveedor ejecutando el modelo de un rival.
Aún no existe una comparación directa independiente. A partir del 8 de octubre de 2026, Artificial Analysis no tiene una página para Haiku 5.5, y no encontramos ningún resultado de Haiku 5.5 en Vals, LMArena, SWE-bench o Aider. La tabla de clasificación de AA de ese día enumera a GPT-6 Luna (máx.) con un Índice de Inteligencia de 38 y 129 tokens de salida por segundo. Resultados completos de Haiku 5.5: benchmarks de Claude Haiku 5.5.
Costo por intento en cada nivel de esfuerzo
La tabla de lanzamiento muestra cada modelo en su máximo. La página de lanzamiento de Anthropic también traza cada nivel de esfuerzo frente al costo, con Luna en dos gráficos.
OSWorld 2.1 (subconjunto sin conexión), puntuación de crédito parcial / costo por intento:
| Esfuerzo | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Bajo | 42.0% / $0.0695 | 19.2% / $0.038 |
| Medio | 53.3% / $0.1257 | 37.5% / $0.1261 |
| Alto | 61.3% / $0.1827 | 42.3% / $0.1435 |
| Muy alto | 67.6% / $0.2792 | 44.8% / $0.1672 |
| Máximo | 72.4% / $0.6111 | 48.9% / $0.205 |
GDPval-AA v2.1, Elo / costo por tarea:
| Esfuerzo | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Bajo | 1125 / $0.01167 | 1036 / $0.0038 |
| Medio | 1277 / $0.03042 | 1262 / $0.02 |
| Alto | 1420 / $0.08938 | 1344 / $0.03 |
| Muy alto | 1513 / $0.26725 | 1364 / $0.05 |
| Máximo | 1620 / $0.86593 | 1437 / $0.09 |
Luna cuesta menos en cada nivel de esfuerzo en GDPval-AA y en cuatro de cinco en OSWorld (en medio, Haiku 5.5 es $0.0004 más barato). En gasto equivalente, Haiku 5.5 lidera en OSWorld; GDPval-AA está cerca. Haiku 5.5 puntúa más alto en todos los niveles. Compara con un gasto equivalente:
- OSWorld: en medio, Haiku 5.5 cuesta $0.1257 por intento frente a los $0.1261 de Luna y puntúa 53.3% frente al 37.5% de Luna. Haiku en medio también supera a Luna en el máximo (48.9%) por menos dinero.
- GDPval-AA: Luna en el máximo (1437, $0.09) y Haiku 5.5 en alto (1420, $0.08938) cuestan aproximadamente lo mismo y se separan por 17 Elo.
Así que, en uso de computadora, Haiku 5.5 compra más puntuación por dólar en la ejecución de Anthropic. En el trabajo de conocimiento, los dos están cerca con el mismo gasto, y el precio base más bajo de Luna gana cuando "suficientemente bueno" es el objetivo.
Enrutamiento: qué modelo para qué carga de trabajo
Anthropic posiciona a Haiku 5.5 para "tareas de alcance limitado" y dice que Sonnet 5.5 y Opus 5.5 "siguen siendo mejores opciones para tareas de codificación agénticas complejas". Ambos modelos aquí están construidos para volumen.
| Carga de trabajo | Empezar con | Por qué |
|---|---|---|
| Clasificación, enrutamiento, extracción por debajo de 100K tokens | Cualquiera; probar ambos | Precio idéntico; elige por precisión para tus etiquetas |
| Preguntas y respuestas de documentos largos, de 100K a 272K tokens | GPT-6 Luna | La tarifa base se mantiene hasta 272K; Haiku 5.5 es 5x más caro por encima de 100K |
| Automatización de navegador y escritorio | Claude Haiku 5.5 | Mayor puntuación en OSWorld con un costo equivalente |
| Subagentes bajo Opus 5.5 o Sonnet 5.5 | Claude Haiku 5.5 | Frontmatter de Claude Code model: haiku (Haiku 5.5 en la API de Anthropic) |
| Menor costo por llamada | GPT-6 Luna | Costo base más bajo: $0.038 (OSWorld) y $0.0038 (GDPval-AA) en bajo |
| Redacción de trabajo de conocimiento con alto esfuerzo | Cualquiera; probar ambos | Dentro de 17 Elo con un gasto equivalente en GDPval-AA |
Consulta Claude Haiku 5.5 en Claude Code para subagentes y GPT-6 Luna para cargas de trabajo de API de alto volumen para pipelines de alto QPS. ¿Vienes de Haiku 4.5? Haiku 5.5 vs Haiku 4.5 lista los cinco nuevos errores 400.
Prueba ambos lado a lado en Apidog
La comparación directa que lo decide se ejecuta con tus propios prompts. En Apidog, crea un proyecto con dos solicitudes y el mismo prompt:
- Almacena
ANTHROPIC_API_KEYy tu clave de OpenAI como variables de entorno. - Añade la solicitud de Haiku 5.5 a continuación, luego la solicitud de Luna con el mismo prompt y esfuerzo.
- Asegúrate de que el
stop_reasonde Haiku no sea"refusal"(no hay un respaldo del lado del servidor) y que elusagese mantenga dentro de tu presupuesto de tokens. - Ejecuta ambos con esfuerzo bajo, medio y alto, y guarda cada respuesta para comparar tokens, latencia y salida.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
]
}'
Omite temperature, top_p y top_k: los valores no predeterminados devuelven un 400 en Haiku 5.5. Tutorial: cómo usar la API de Claude Haiku 5.5. Para conjuntos de evaluación, consulta prueba de aplicaciones LLM.
Preguntas frecuentes
¿Claude Haiku 5.5 y GPT-6 Luna tienen el mismo precio? Sí, para prompts de Haiku de hasta 100K tokens: $0.10/$0.50, $0.01 por lecturas de caché, $0.125 por escrituras de caché. Por encima de eso, Haiku 5.5 cuesta $0.50/$2.50 mientras que Luna se mantiene en la tarifa base hasta los 272K.
¿Qué modelo puntúa más alto? Haiku 5.5, en cada fila compartida de la tabla de lanzamiento de Anthropic. Anthropic compiló esa tabla; aún no existe una comparación directa independiente.
¿Cuál es más barato por tarea? Generalmente Luna: en cada nivel de esfuerzo en el gráfico GDPval-AA de Anthropic y en cuatro de cinco en OSWorld (en medio, Haiku 5.5 es $0.0004 más barato). Con un gasto equivalente, Haiku 5.5 lidera en OSWorld; GDPval-AA está cerca.
¿Es alguno de ellos gratuito? Solo en el chat: los usuarios gratuitos de Claude.ai pueden seleccionar Haiku 5.5, y los usuarios gratuitos y Go obtienen Luna en la aplicación de escritorio ChatGPT. Ninguno te da una clave API. Consulta Claude Haiku 5.5 gratis.
Elige por longitud del prompt, luego prueba
Revisa primero las longitudes de tus prompts. Por debajo de 100K tokens, el precio es un empate y la precisión decide, donde los números de Anthropic favorecen a Haiku 5.5. Entre 100K y 272K, el umbral de Luna ahorra dinero en cada llamada. Luego ejecuta ambos en solicitudes reales con dos o tres niveles de esfuerzo: descarga Apidog, coloca ambas solicitudes en un proyecto y deja que los números de usage decidan.
