Claude Haiku 5.5 é o modelo atual menor e mais rápido da Anthropic, lançado em 7 de outubro de 2026, com o ID da API claude-haiku-5-5. Ele custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída para prompts de até 100 mil tokens, e US$ 0,50/US$ 2,50 para prompts acima de 100 mil. Em sua publicação de lançamento, a Anthropic afirma que ele custa “cerca de 75% menos para rodar” do que o Haiku 4.5 em média, e o chama de “nosso modelo mais rápido até o momento”. É também o primeiro Haiku com uma configuração de esforço e traz uma janela de contexto de 1 milhão de tokens.
Abaixo: especificações, o preço de dois níveis, mudanças em relação ao Haiku 4.5, benchmarks, onde executá-lo e quem deve mudar, com links para guias mais aprofundados, como o detalhamento de preços do Haiku 5.5. Para chamar o modelo enquanto você lê, o Apidog pode enviar a solicitação de Mensagens, manter sua chave em uma variável de ambiente e mostrar a resposta ao lado de seu uso de tokens.
Especificações do Claude Haiku 5.5 em resumo
| Especificação | Claude Haiku 5.5 |
|---|---|
| Data de lançamento | 7 de outubro de 2026 |
| ID do modelo (API Claude, Google Cloud, Microsoft Foundry, Plataforma Claude na AWS) | claude-haiku-5-5 (ID fixo, sem sufixo de data) |
| ID do modelo (Amazon Bedrock) | anthropic.claude-haiku-5-5 |
| Janela de contexto | 1M tokens (Haiku 4.5: 200K) |
| Saída máxima | 128K (Haiku 4.5: 64K); 300K na API Batch com o cabeçalho beta output-300k-2026-03-24 |
| Pensamento | Apenas adaptativo |
| Níveis de esforço | baixo, médio (padrão), alto, xalto, máx |
| Data de corte de conhecimento | Junho de 2026 |
| Preço por MTok, prompts de até 100K tokens | US$ 0,10 entrada, US$ 0,50 saída |
| Preço por MTok, prompts acima de 100K tokens | US$ 0,50 entrada, US$ 2,50 saída |
| Descontinuação | Não antes de 7 de outubro de 2027 |
Onde o Haiku 5.5 se encaixa na linha Claude
| Modelo | Entrada / saída por MTok | Esforço padrão | Latência |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | alto | Mais lento |
| Claude Opus 5.5 | $4 / $20 | médio | Moderado |
| Claude Sonnet 5.5 | $2 / $10 | alto | Rápido |
| Claude Haiku 5.5 | $0.10 / $0.50 para prompts de até 100K tokens | médio | Mais rápido |
Os quatro compartilham uma janela de contexto de 1M, saída máxima de 128K e um corte de dados de junho de 2026. A Anthropic construiu o Haiku 5.5 “para tarefas de alto volume e sensíveis à latência, como classificação, extração e roteamento”, além de resumos, suporte ao vivo, uso do navegador e trabalho de subagente sob o Opus 5.5 ou Sonnet 5.5.
A alegação de velocidade tem uma ressalva: o mais rápido “na velocidade padrão de cada modelo”, mas mais lento que o Opus no Modo Rápido. A Anthropic não publica um valor de tokens por segundo.
Preços do Claude Haiku 5.5
O preço depende do comprimento do prompt. Um prompt com mais de 100.000 tokens paga a tarifa mais alta.

Fonte: Preços da API Claude.
O valor de “cerca de 75% menos” é uma média: 90% mais barato que o Haiku 4.5 para prompts de até 100K tokens, 50% mais barato acima disso, com 90% das solicitações do Haiku 4.5 abaixo do limite. Isso já considera o novo tokenizador, que produz cerca de 30% mais tokens para o mesmo texto.
A inferência apenas nos EUA (inference_geo) custa 1,1x em todas as categorias de tokens. O prompt mínimo armazenável em cache cai para 512 tokens, de 4.096 no Haiku 4.5.
Abaixo de 100 mil tokens, o preço de tabela corresponde exatamente ao GPT-6 Luna (US$ 0,10 de entrada, US$ 0,50 de saída, US$ 0,01 de leitura de cache, US$ 0,125 de gravação de cache). Os limites diferem: a sobretaxa do Luna começa acima de 272 mil tokens de entrada. A comparação do Haiku 5.5 vs GPT-6 Luna detalha essa diferença, e o guia de preços tem exemplos de custos calculados.
O que mudou em relação ao Haiku 4.5
A janela de contexto aumenta cinco vezes, a saída máxima dobra e você obtém controle de esforço pela primeira vez. O guia de migração adverte que o código escrito para o Haiku 4.5 pode quebrar. Cinco mudanças retornam um erro 400:
- Orçamentos de pensamento manuais.
thinking: {"type": "enabled", "budget_tokens": N}falha. Use{"type": "adaptive"}comoutput_config.effort. - Parâmetros de amostragem. Remova
temperature,top_petop_k. Valores não padrão detemperatureoutop_pfalham, assim como qualquertop_kou o envio de ambostemperatureetop_p. - Pré-preenchimento do assistente. Rejeitado, mesmo com o pensamento desativado.
- Ferramenta de uso de computador antiga. Na API Claude e no Google Cloud, use
computer_toolset_20260801;computer_20250124falha. - Histórico editado. Alterar
system,toolsou mensagens anteriores antes de um bloco de pensamento retornado falha. Mantenha as conversas apenas com anexos.
Outras mudanças não causarão um erro, mas alterarão seus resultados:
- Exibição do pensamento. Blocos de pensamento retornam vazios por padrão, com apenas uma assinatura. Defina
"display": "summarized"para lê-los. - Contagem de tokens. Cerca de 30% mais tokens para o mesmo texto;
max_tokenstambém cobre o pensamento. - Uso forçado de ferramenta.
tool_choicedeanyou uma ferramenta nomeada ainda funciona, mas a resposta não tem um bloco de pensamento. - Recusas. Classificadores de segurança podem retornar
stop_reason: "refusal", sem fallback do lado do servidor. - Nível de prioridade. Não suportado no Haiku 5.5.
O pensamento pode ser desativado na API com esforço alto ou inferior; em xalto e máx, isso retorna um 400. O Haiku 4.5 não está descontinuado: ainda está listado como ativo. O guia Haiku 5.5 vs Haiku 4.5 tem JSON antes/depois para cada correção.
Benchmarks do Claude Haiku 5.5
As pontuações do Haiku 5.5 são no esforço máximo, principalmente a média de cinco tentativas. A Artificial Analysis executou GDPval-AA e AA-Briefcase, a Cognition executou FrontierCode, e a Anthropic classificou Chartography (um benchmark da Surge AI) com sua própria implementação.

Leia três células com atenção. O FrontierCode coloca o Haiku no máximo contra o Sonnet 5.5 no xhigh; no máximo, o Sonnet marcou 46,2%, abaixo dos 46,4% do Haiku. A Anthropic executou a pontuação OSWorld do Luna através da API da OpenAI, enquanto a pontuação Terminal-Bench do Luna vem da classificação pública (Codex CLI). E no esforço padrão médio, o Haiku 5.5 marcou 1277 no GDPval-AA e 1372 no AA-Briefcase.
A Anthropic afirma que o Sonnet 5.5 e o Opus 5.5 “permanecem melhores escolhas para tarefas complexas de codificação agentic”. Nenhuma classificação independente tinha um resultado do Haiku 5.5 até 8 de outubro de 2026; o Cursor relata 48,4% em seu próprio CursorBench no máximo. O mergulho profundo nos benchmarks tem pontuações e custos por esforço.
Onde você pode usar o Claude Haiku 5.5
| Interface | Acesso | Notas |
|---|---|---|
| API Claude | claude-haiku-5-5 |
Pagamento por token |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Faturado via AWS Marketplace |
| Google Cloud, Microsoft Foundry, Plataforma Claude na AWS | claude-haiku-5-5 |
Mesmo ID da API Claude |
| Claude.ai (web, iOS, Android) | Seletor de modelo | Usuários Free, Pro, Max, Team e Enterprise podem selecioná-lo |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293 ou posterior; planos pagos |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
A partir de $0.10 / $0.50 |
| Cursor | claude-haiku-5-5 |
Outros modelos disponíveis |
Até 8 de outubro de 2026, ele não estava no OpenRouter ou anunciado para o GitHub Copilot.
O acesso ao chat no plano Gratuito não é uma chave de API, e a API é paga, além dos pequenos créditos gratuitos que a Anthropic oferece a novos usuários para testes. Os planos Max e Team agora incluem créditos mensais de API (US$ 100 no Max 5x, US$ 200 no Max 20x, até US$ 500 agrupados no Team), que não cobrem o Claude Code. O guia de acesso gratuito lista o que é e o que não é gratuito.
No Claude Code, o apelido haiku significa Haiku 5.5 apenas na API da Anthropic; em outros lugares, ainda significa Haiku 4.5. Consulte Haiku 5.5 no Claude Code para configurações de subagentes.
Quem deve mudar para o Haiku 5.5
- Você usa o Haiku 4.5: mude, depois de corrigir as cinco mudanças que quebram a compatibilidade. O Haiku 5.5 supera o Haiku 4.5 em todas as linhas da tabela de lançamento onde ambos têm uma pontuação, a um preço de tabela mais baixo.
- Você usa o Sonnet ou Opus para trabalhos simples e repetitivos: teste o Haiku 5.5 para classificação, extração, resumos e trabalho de subagente. Mantenha o modelo maior para tarefas complexas de codificação agentic.
- Seus prompts frequentemente excedem 100K tokens: precifique ambos os níveis antes de se comprometer. Acima do limite, os custos de entrada são 5 vezes mais caros por token.
- Você faz trabalho de segurança: as salvaguardas cibernéticas do Haiku 5.5 ainda bloqueiam testes de penetração.
Na postagem de lançamento da Anthropic, a Asana relata uma latência 30% menor nas conclusões de tarefas, e a Box viu uma pontuação 11 pontos acima do Haiku 4.5 com cerca de metade da latência. Estas são alegações de clientes, não testes independentes.
O cartão do sistema observa que ele recusou mais do que qualquer outro modelo na auditoria automatizada da Anthropic, então teste as taxas de recusa em seus próprios prompts.
Envie sua primeira solicitação Haiku 5.5
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
]
}'
Omita os parâmetros de amostragem e o pré-preenchimento. Leia os blocos de conteúdo por type, já que a resposta pode começar com um bloco de pensamento.
No Apidog, importe o comando curl como uma nova solicitação e armazene a chave em uma variável de ambiente ANTHROPIC_API_KEY. Adicione asserções de que stop_reason não é refusal ou max_tokens. Em seguida, duplique a solicitação em medium e compare o usage para ver o custo de cada nível de esforço. O guia da API Haiku 5.5 aborda cache, lote e streaming, e o guia da chave da API Anthropic ajuda se você precisar de uma chave.
FAQ
Quando o Claude Haiku 5.5 foi lançado? 7 de outubro de 2026, nove dias após o Sonnet 5.5.
O Claude Haiku 5.5 é gratuito? No aplicativo de chat Claude.ai, usuários Grátis podem selecioná-lo. A API é paga, à parte de pequenos créditos de teste para novos usuários. Veja todas as rotas gratuitas.
Qual é a janela de contexto do Claude Haiku 5.5? 1 milhão de tokens, com 128 mil de saída máxima na API de Mensagens.
O Haiku 4.5 está sendo descontinuado? Ainda não. Ele ainda está listado como ativo, com descontinuação não antes de 15 de outubro de 2026.
Próximo passo
Escolha uma tarefa de alto volume que você executa hoje, como triagem de tickets ou resumos de documentos. Envie-a para claude-haiku-5-5 com esforço low e medium, verifique a saída e compare o usage com seu modelo atual. Baixe o Apidog para manter essas solicitações e asserções em um único projeto, depois use o guia de preços para transformar as contagens de tokens em uma fatura mensal.
