Claude Haiku 5.5 e GPT-6 Luna compartilham um preço de tabela: $0.10/$0.50 por milhão de tokens de entrada/saída para prompts Haiku de até 100K tokens, com $0.01 para leituras de cache e $0.125 para escritas de cache em ambos. A diferença está onde esse preço termina. Haiku 5.5 muda para $0.50/$2.50 acima de 100K tokens; Luna mantém sua tarifa base até 272K tokens de entrada, depois cobra 2x a entrada e 1.5x a saída. Na tabela de lançamento da Anthropic, Haiku 5.5 pontua mais alto em todas as linhas compartilhadas. Nos próprios gráficos de custo da Anthropic, Luna é mais barata por tarefa em todos os níveis de esforço GDPval-AA e em quatro de cinco no OSWorld; no OSWorld médio, Haiku 5.5 é marginalmente mais barato.
Abaixo: preço, especificações, os benchmarks compartilhados e quem os executou, curvas de custo por esforço e roteamento por carga de trabalho. Para cada modelo individualmente, veja o que é Claude Haiku 5.5 e o que é GPT-6 Luna. A última seção envia o mesmo prompt para ambos no Apidog.
Preço lado a lado
| Por 1M tokens | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Entrada, nível base | $0.10 (prompts de até 100K tokens) | $0.10 (até 272K tokens de entrada) |
| Saída, nível base | $0.50 | $0.50 |
| Leitura de cache, nível base | $0.01 | $0.01 |
| Escrita de cache, nível base | $0.125 (5 minutos) | $0.125 |
| Nível superior, entrada / saída | $0.50 / $2.50 (acima de 100K) | $0.20 / $0.75 (acima de 272K) |
| Nível superior, leitura / escrita de cache | $0.05 / $0.625 | 2x as taxas de cache |
| Lote | $0.05 / $0.25 até 100K; $0.25 / $1.25 acima | 50% das taxas Padrão (Lote e Flex) |
Fontes: documentos de precificação da Anthropic e página do modelo GPT-6 Luna da OpenAI. A OpenAI reprecifica "a requisição completa" acima de 272K. A Anthropic afirma que "um prompt com mais de 100.000 tokens paga preços mais altos", cobrado por requisição de acordo com o comprimento do prompt.
Abaixo de 100K tokens, as contas se equivalem linha por linha. Entre 100K e 272K, Haiku 5.5 custa 5x mais que Luna em entrada e saída. Acima de 272K, ambos estão em seu nível superior, e Luna ainda é mais barata.
Dois exemplos, contados nos próprios tokens de cada fornecedor:
- Prompt de 150K tokens, 2K de saída. Haiku 5.5: 0.15 × $0.50 + 0.002 × $2.50 = $0.080. Luna: 0.15 × $0.10 + 0.002 × $0.50 = $0.016.
- Prompt de 300K tokens, 2K de saída. Haiku 5.5: 0.30 × $0.50 + 0.002 × $2.50 = $0.155. Luna: 0.30 × $0.20 + 0.002 × $0.75 = $0.0615.
A Anthropic diz que prompts de até 100K tokens representaram cerca de 90% das requisições do Haiku 4.5. Se seu tráfego se parece com isso, a maioria de suas chamadas custa o mesmo em qualquer um dos modelos. Mais cálculos em precificação do Claude Haiku 5.5.
Tokenizers mudam o limite
Um token em um modelo não é um token no outro. O tokenizer atualizado do Haiku 5.5 produz cerca de 30% mais tokens do que o Haiku 4.5 para o mesmo texto, segundo a Anthropic. No tópico de lançamento do Hacker News, um comentarista estimou que "100K tokens do Claude moderno equivalem a cerca de ~60-65K tokens GPT modernos". Essa é uma estimativa da comunidade, não um dado do fornecedor. Se isso se mantiver, o limite de 100K do Haiku é atingido mais cedo em termos de texto do que os números brutos sugerem. Conte seus próprios prompts em ambas as APIs e leia cada objeto usage.
Especificações
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| ID do modelo API | claude-haiku-5-5 |
gpt-6-luna |
| Janela de contexto | 1M tokens | 1,050,000 tokens |
| Saída máxima | 128K tokens (300K em Lote com um cabeçalho beta) | 128,000 tokens |
| Corte de conhecimento | Junho de 2026 | 18 de maio de 2026 |
| Níveis de esforço | baixo, médio (padrão), alto, xalto, máximo | nenhum, baixo, médio (padrão), alto, xalto, máximo |
| Pensamento desativado | thinking: {"type": "disabled"} em esforço alto ou abaixo |
none esforço de raciocínio |
| Acesso gratuito ao chat | Usuários gratuitos do Claude.ai podem selecioná-lo | Usuários Free e Go no aplicativo de desktop do ChatGPT |
Ambos têm medium como padrão. No Haiku 5.5, o parâmetro é output_config.effort; no Luna, é reasoning.effort. Nenhuma rota de chat gratuita é uma chave de API, então não pode acionar um script, trabalho de CI ou agente. Veja Claude Haiku 5.5 gratuitamente e GPT-6 Luna gratuitamente.
Uma diferença de cache importa em loops. No Haiku 5.5, alterar o effort de nível superior entre as requisições invalida o cache do prompt. A OpenAI diz que alterar o esforço de raciocínio não invalida mais o cache nos modelos GPT-6 (cache de prompt GPT-6).
Benchmarks: Tabela da Anthropic e quem executou cada célula Luna
Todos os números abaixo vêm da publicação de lançamento da Anthropic e de seu cartão de sistema. A Anthropic compilou a tabela, mas diferentes partes executaram diferentes linhas. Os resultados do Haiku 5.5 são no esforço máximo, principalmente com média de cinco tentativas.
| Benchmark | Haiku 5.5 | GPT-6 Luna | Como a célula Luna foi obtida |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Executado independentemente pela Artificial Analysis |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Executado independentemente pela Artificial Analysis |
| OSWorld 2.1, subconjunto offline | 72.4% | 48.9% | Executado pela Anthropic nas mesmas 82 tarefas via API da OpenAI |
| Terminal-Bench 4.0 | 39.2% | 16.4% | Ranking público, Codex CLI em esforço máximo |
| FrontierCode 1.1 (Principal) | 46.4% | 42.4% | Executado pela Cognition (Claude no Claude Code, GPT no Codex) |
| Cartografia, sem ferramentas | 46.4% | 29.1% | Conforme publicamente relatado pela Surge AI |
As linhas compartilham um nome de benchmark, não um harness: Terminal-Bench coloca Haiku 5.5 no Claude Code contra Luna no Codex CLI. OSWorld é o mais próximo de controlado, já que a Anthropic executou ambos os modelos nas mesmas tarefas, mas ainda é um fornecedor executando o modelo de um rival.
Ainda não existe um confronto independente. Em 8 de outubro de 2026, a Artificial Analysis não tem uma página para Haiku 5.5, e não encontramos resultados de Haiku 5.5 em Vals, LMArena, SWE-bench ou Aider. O ranking da AA naquele dia lista GPT-6 Luna (máx) com um Índice de Inteligência de 38 e 129 tokens de saída por segundo. Resultados completos do Haiku 5.5: benchmarks do Claude Haiku 5.5.
Custo por tentativa em cada nível de esforço
A tabela de lançamento mostra cada modelo no máximo. A página de lançamento da Anthropic também plota cada nível de esforço em relação ao custo, com Luna em dois gráficos.
OSWorld 2.1 (subconjunto offline), pontuação de crédito parcial / custo por tentativa:
| Esforço | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Baixo | 42.0% / $0.0695 | 19.2% / $0.038 |
| Médio | 53.3% / $0.1257 | 37.5% / $0.1261 |
| Alto | 61.3% / $0.1827 | 42.3% / $0.1435 |
| Xalto | 67.6% / $0.2792 | 44.8% / $0.1672 |
| Máximo | 72.4% / $0.6111 | 48.9% / $0.205 |
GDPval-AA v2.1, Elo / custo por tarefa:
| Esforço | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Baixo | 1125 / $0.01167 | 1036 / $0.0038 |
| Médio | 1277 / $0.03042 | 1262 / $0.02 |
| Alto | 1420 / $0.08938 | 1344 / $0.03 |
| Xalto | 1513 / $0.26725 | 1364 / $0.05 |
| Máximo | 1620 / $0.86593 | 1437 / $0.09 |
Luna custa menos em todos os níveis de esforço no GDPval-AA e nos níveis baixo, alto, xalto e máximo no OSWorld. No OSWorld médio, Haiku 5.5 é marginalmente mais barato ($0.1257 vs $0.1261). Haiku 5.5 pontua mais alto em todos os níveis. Compare com o mesmo gasto:
- OSWorld: no nível médio, Haiku 5.5 custa $0.1257 por tentativa contra $0.1261 de Luna e pontua 53.3% contra 37.5% de Luna. Haiku no nível médio também supera Luna no máximo (48.9%) por menos dinheiro.
- GDPval-AA: Luna no máximo (1437, $0.09) e Haiku 5.5 no alto (1420, $0.08938) custam aproximadamente o mesmo e têm uma diferença de 17 Elo.
Assim, no uso de computador, Haiku 5.5 obtém mais pontuação por dólar na execução da Anthropic. No trabalho de conhecimento, os dois são próximos com gastos iguais, e o piso mais baixo de Luna vence quando "bom o suficiente" é o objetivo.
Roteamento: qual modelo para qual carga de trabalho
A Anthropic posiciona Haiku 5.5 para "tarefas de escopo restrito" e diz que Sonnet 5.5 e Opus 5.5 "permanecem melhores escolhas para tarefas complexas de codificação agentica". Ambos os modelos aqui são construídos para volume.
| Carga de trabalho | Comece com | Porquê |
|---|---|---|
| Classificação, roteamento, extração abaixo de 100K tokens | Qualquer um; teste ambos | Preço idêntico; escolha com base na precisão para suas etiquetas |
| Q&A de documentos longos, 100K a 272K tokens | GPT-6 Luna | Tarifa base se mantém até 272K; Haiku 5.5 custa 5x mais acima de 100K |
| Automação de navegador e desktop | Claude Haiku 5.5 | Pontuação OSWorld mais alta com custo equivalente |
| Subagentes sob Opus 5.5 ou Sonnet 5.5 | Claude Haiku 5.5 | Frontmatter Claude Code model: haiku (Haiku 5.5 na API da Anthropic) |
| Menor custo por chamada | GPT-6 Luna | Piso mais barato: $0.038 (OSWorld) e $0.0038 (GDPval-AA) no nível baixo |
| Rascunho de trabalho de conhecimento com alto esforço | Qualquer um; teste ambos | Dentro de 17 Elo com gasto equivalente no GDPval-AA |
Veja Claude Haiku 5.5 no Claude Code para subagentes e GPT-6 Luna para cargas de trabalho de API de alto volume para pipelines de alto QPS. Vindo do Haiku 4.5? Haiku 5.5 vs Haiku 4.5 lista os cinco novos erros 400.
Teste ambos lado a lado no Apidog
O confronto que decide tudo é executado com seus prompts. No Apidog, crie um projeto com duas requisições e o mesmo prompt:
- Armazene
ANTHROPIC_API_KEYe sua chave OpenAI como variáveis de ambiente. - Adicione a requisição Haiku 5.5 abaixo, depois a requisição Luna com o mesmo prompt e esforço.
- Verifique se o
stop_reasondo Haiku não é"refusal"(não há fallback no lado do servidor) e se ousagepermanece dentro do seu orçamento de tokens. - Execute ambos com esforço baixo, médio e alto e salve cada resposta para comparar tokens, latência e saída.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "Classifique este tíquete de suporte como cobrança, bug ou solicitação de recurso: O botão de exportação retorna um erro 500 desde esta manhã."}
]
}'
Omita temperature, top_p e top_k: valores não padrão retornam um erro 400 no Haiku 5.5. Passo a passo: como usar a API Claude Haiku 5.5. Para conjuntos de avaliação, veja testando aplicativos LLM.
FAQ
Claude Haiku 5.5 e GPT-6 Luna têm o mesmo preço? Sim, para prompts Haiku de até 100K tokens: $0.10/$0.50, $0.01 para leituras de cache, $0.125 para escritas de cache. Acima disso, Haiku 5.5 custa $0.50/$2.50 enquanto Luna permanece na tarifa base até 272K.
Qual modelo pontua mais alto? Haiku 5.5, em todas as linhas compartilhadas da tabela de lançamento da Anthropic. A Anthropic compilou essa tabela; ainda não existe um confronto independente.
Qual é mais barata por tarefa? Geralmente Luna: em todos os níveis de esforço no gráfico GDPval-AA da Anthropic e em quatro de cinco no OSWorld (no médio, Haiku 5.5 é $0.0004 mais barato). Com o mesmo gasto, Haiku 5.5 se destaca no OSWorld; GDPval-AA é próximo.
Algum é gratuito? Apenas no chat: Usuários gratuitos do Claude.ai podem selecionar Haiku 5.5, e usuários Free e Go obtêm Luna no aplicativo de desktop do ChatGPT. Nenhum oferece uma chave de API. Veja Claude Haiku 5.5 gratuitamente.
Escolha pelo comprimento do prompt, depois teste
Verifique primeiro o comprimento dos seus prompts. Abaixo de 100K tokens, o preço é um empate e a precisão decide, onde os números da Anthropic favorecem Haiku 5.5. Entre 100K e 272K, o limite de Luna economiza dinheiro em cada chamada. Em seguida, execute ambos em requisições reais em dois ou três níveis de esforço: baixe o Apidog, coloque ambas as requisições em um projeto, e deixe os números de usage decidirem.
