O Claude Haiku 5.5 (claude-haiku-5-5, lançado em 7 de outubro de 2026) custa 90% menos que o Haiku 4.5 para prompts de até 100K tokens ($0.10/$0.50 por milhão de tokens de entrada/saída vs $1/$5), possui uma janela de contexto de 1M tokens em vez de 200K, e pontua muito mais alto em todos os benchmarks de lançamento que listam ambos. A ressalva: cinco formatos de requisição que funcionavam no 4.5 agora retornam um erro 400, e várias outras mudanças alteram respostas e custos sem erro.
Abaixo: uma tabela comparativa, cada mudança disruptiva com JSON antes/depois, as mudanças silenciosas e um plano de teste para Apidog. Para a folha de especificações completa, leia o que é Claude Haiku 5.5. Se você ainda está usando o modelo mais antigo, nosso guia da API Claude Haiku 4.5 o aborda.
Haiku 4.5 vs Haiku 5.5: um panorama
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| ID do Modelo (API Claude) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Contexto / saída máxima | 200K / 64K | 1M / 128K |
| Entrada / saída por MTok | $1 / $5 | $0.10 / $0.50 para prompts de até 100K tokens; $0.50 / $2.50 acima |
| Leitura de cache / escrita de 5m por MTok | $0.10 / $1.25 | $0.01 / $0.125 até 100K; $0.05 / $0.625 acima |
| Entrada / saída em lote por MTok | $0.50 / $2.50 | $0.05 / $0.25 até 100K; $0.25 / $1.25 acima |
| Processamento | Manual budget_tokens |
Adaptativo apenas, ativado por padrão |
| Níveis de esforço | Nenhum | baixo, médio (padrão), alto, xalto, máximo |
| Prompt mínimo armazenável em cache | 4.096 tokens | 512 tokens |
| Tokenizador | Mais antigo | Cerca de 30% mais tokens para o mesmo texto |
| Parâmetros de amostragem não padrão, pré-preenchimento | Aceito | erro 400 |
| Nível de Prioridade | Suportado | Não suportado |
| Status | Ativo, desativação não antes de 15 de outubro de 2026 | Ativo, desativação não antes de 7 de outubro de 2027 |
O Haiku 4.5 não está depreciado. A página de depreciação de modelos o lista como Ativo sem data de depreciação, então você pode migrar no seu próprio cronograma. Os limites de taxa são os mesmos em ambos.
As cinco mudanças disruptivas
Cada uma retorna um erro 400 no Haiku 5.5 para um corpo que funciona no 4.5. O guia de migração do Haiku 5.5 lista todas elas.
1. Processamento manual com budget_tokens
O Haiku 5.5 executa apenas processamento adaptativo. Um orçamento fixo é rejeitado.
// Antes (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classifique este ticket." }]
}
// Depois (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classifique este ticket." }]
}
O esforço é agora a alavanca: onde o 4.5 usava um orçamento pequeno, escolha um esforço menor. Você ainda pode enviar thinking: {"type": "disabled"}, mas apenas com esforço alto ou inferior; em xhigh ou max, isso também resulta em um erro 400.
2. Parâmetros de amostragem
Remova temperature, top_p e top_k. Os únicos valores aceitos são temperature: 1 e top_p: 0.99. Qualquer outro valor resulta em um erro 400, incluindo top_p: 1, qualquer top_k, e o envio de temperature e top_p juntos.
// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extraia o ID do pedido." }] }
// Depois (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extraia o ID do pedido." }] }
Se você usava uma temperatura baixa para uma saída consistente, mova essa intenção para o prompt.
3. Pré-preenchimento do assistente
Uma última vez do assistente para o modelo continuar é rejeitada, mesmo com o processamento desativado. Termine as messages com uma vez do usuário.
// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Retorne o sentimento como JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// Depois (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Responda apenas com um objeto JSON. Sem preâmbulo.",
"messages": [
{ "role": "user", "content": "Retorne o sentimento como JSON." }
] }
Para formatos estritos, o guia de migração aponta para saídas estruturadas ou uma ferramenta com campos enum para classificação.
4. Uso de computador: de computer_20250124 para computer_toolset_20260801
Na API Claude e no Google Cloud, o Haiku 5.5 suporta o uso de computador apenas através do novo conjunto de ferramentas. Remova o cabeçalho beta computer-use-2025-01-24 e remova fine-grained-tool-streaming-2025-05-14 se você o enviar, pois ele resulta em um erro 400 junto com um conjunto de ferramentas.
// Antes (Haiku 4.5, cabeçalho anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Abra a página de configurações." }] }
// Depois (Haiku 5.5, sem cabeçalho beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Abra a página de configurações." }] }
Seu loop de agente também muda: despache em name e toolset_name de cada bloco tool_use em vez de input.action, e ecoe toolset_name nos resultados. O Haiku 5.5 também inclui a ferramenta de uso do navegador (browser_toolset_20260801), que o Haiku 4.5 não suporta. Veja uso de computador no Claude Code para uma visão mais ampla.
5. Edição de turnos anteriores antes de um bloco de processamento
Um bloco de processamento do Haiku 5.5 permanece válido apenas enquanto tudo o que foi enviado antes dele não for alterado. Altere system, tools ou uma mensagem anterior e reenvie o bloco, e você receberá um erro 400. O Haiku 4.5 nunca executou essa verificação. Aqui, o turno 1 enviou "system": "Você é um agente de cobrança." e o turno 2 o edita.
// Antes: sistema editado + bloco de processamento reproduzido = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "Você é um agente de cobrança. Seja breve.",
"messages": [
{ "role": "user", "content": "Por que fui cobrado duas vezes?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Verificando." } ] },
{ "role": "user", "content": "Pedido 4412." }
] }
// Depois: turnos anteriores inalterados, nova instrução anexada
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "Você é um agente de cobrança.",
"messages": [
{ "role": "user", "content": "Por que fui cobrado duas vezes?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Verificando." } ] },
{ "role": "user", "content": "Pedido 4412. Seja breve." }
] }
Em contas criadas antes de 31 de agosto de 2026, 00:00 UTC, o erro aparece apenas em requisições que definem thinking.block_binding.prefix_mismatch_behavior.
Mudanças silenciosas que não gerarão um erro
- Campo de processamento vazio por padrão. Cada bloco
thinkingretorna com um campothinkingvazio e apenas umasignature. O Haiku 4.5 retornava um processamento resumido. Definathinking: {"type": "adaptive", "display": "summarized"}se você o registrar ou exibir. - Respostas podem começar com processamento. O processamento adaptativo está ativado mesmo quando você não o define, então selecione os blocos de conteúdo por
type, não por índice. - Cerca de 30% mais tokens. O novo tokenizador contabiliza o mesmo texto como aproximadamente 30% mais tokens. Reconte os prompts e lembre-se de que os tokens de processamento contam para
max_tokens, então um limite pequeno pode parar comstop_reason: "max_tokens"antes de qualquer texto. tool_choiceforçado ignora o processamento.anyou uma ferramenta nomeada ainda funciona, mas a resposta começa com a chamada da ferramenta e sem blocothinking. Usetool_choice: {"type": "auto"}e diga ao modelo quando chamar a ferramenta se você quiser que ele raciocine primeiro.- Novas recusas, sem fallback. O Haiku 5.5 executa classificadores de segurança (
cyber,frontier_llm,bio,general_harms) que podem retornarstop_reason: "refusal". Não há fallback no lado do servidor, e uma nova tentativa geralmente resulta em recusa novamente. - Nível de Prioridade foi removido. Se você tem um compromisso de Nível de Prioridade no Haiku 4.5, planeje a capacidade separadamente.
- Blocos de processamento são vinculados à conta. Eles funcionam apenas na conta que os produziu ou em uma conta vinculada. A reprodução de conversas armazenadas através de outra conta perde esse raciocínio.
- O armazenamento em cache mais barato começa mais cedo. O prompt mínimo armazenável em cache cai de 4.096 para 512 tokens, então prompts de sistema curtos que nunca foram armazenados em cache no 4.5 agora o são.
O que melhorou
Estes são números reportados pela Anthropic com o Haiku 5.5 no esforço máximo; a Artificial Analysis executou o GDPval-AA e o AA-Briefcase independentemente.
| Benchmark | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, offline subset | 15.7% | 72.4% |
| Humanity’s Last Exam, with tools | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multilingual | 67.4% | 83.7% |
| Chartography, no tools | 6.4% | 46.4% |
A execução do Terminal-Bench do Haiku 4.5 usou um orçamento fixo de 63.999 tokens para o processamento. Com o esforço médio padrão, o Haiku 5.5 obteve 1277 no GDPval-AA, ainda bem acima do 4.5. A Box relatou pontuações 11 pontos mais altas que o Haiku 4.5 com cerca de metade da latência. As tabelas completas estão em benchmarks do Claude Haiku 5.5.
A Anthropic ainda posiciona o Sonnet 5.5 e o Opus 5.5 como melhores escolhas para codificação agêntica complexa. O Haiku 5.5 visa classificação, extração, sumarização, compactação, subagentes e uso de navegador.
Em termos de custo, a Anthropic afirma que o Haiku 5.5 é cerca de 75% mais barato em média. Esse número combina preços 90% mais baixos para até 100K tokens e 50% mais baixos acima, e já compensa os tokens extras do novo tokenizador. O prompt de sistema de uso de ferramenta também encolheu, de 496 para 286 tokens com a escolha de ferramenta auto. Exemplos trabalhados estão em preços do Claude Haiku 5.5.
Teste a migração no Apidog
No Apidog, crie um projeto com três requisições salvas para https://api.anthropic.com/v1/messages:

- Linha de base: seu corpo atual do Haiku 4.5. Afirme o status 200.
- Corpo antigo, novo modelo: altere apenas
modelparaclaude-haiku-5-5. Afirme o status 400. Mantenha uma cópia para cada mudança disruptiva que você encontrar. - Migrado: o corpo corrigido. Afirme o status 200, um
stop_reasonque não sejarecusaoumax_tokens, e um bloco de texto encontrado portype.
Armazene ANTHROPIC_API_KEY como uma variável de ambiente e referencie-a como {{ANTHROPIC_API_KEY}} no cabeçalho x-api-key, com anthropic-version: 2023-06-01. Compare usage.input_tokens entre as requisições de linha de base e migradas para ver a mudança do tokenizador em seus próprios prompts. Salve o conjunto como um cenário de teste, e um colega de equipe que reintroduzir temperature falhará a execução em vez da produção. Os fundamentos da requisição estão em como usar a API Claude Haiku 5.5.
Se você trabalha no Claude Code, /claude-api migrate this project to claude-haiku-5-5 aplica a troca de ID do modelo e as correções de parâmetros, e então lhe fornece uma lista de verificação. Observe que o alias haiku resolve para Haiku 5.5 apenas na API da Anthropic; veja Claude Haiku 5.5 no Claude Code.
Perguntas Frequentes
O Claude Haiku 4.5 está depreciado? Não. Ele está listado como Ativo sem data de depreciação, e sua desativação não é antes de 15 de outubro de 2026.
Por que minha requisição Haiku 4.5 retorna um erro 400 no Haiku 5.5? Verifique por budget_tokens, temperature/top_p/top_k, um pré-preenchimento do assistente, computer_20250124, ou edições em turnos anteriores antes de um bloco de processamento. Essas são as cinco mudanças disruptivas.
O Haiku 5.5 é mais barato que o Haiku 4.5 para prompts longos? Sim. Acima de 100K tokens, ele custa $0.50/$2.50 por milhão, metade do $1/$5 do Haiku 4.5. O Haiku 4.5 não consegue processar prompts além de 200K.
Devo mudar tudo para o Haiku 5.5? Para classificação, extração e trabalho de subagentes, teste-o primeiro e depois faça a mudança. Compare-o com seu rival mais próximo em Haiku 5.5 vs GPT-6 Luna.
Próximo passo
Salve sua requisição Haiku 4.5 ao lado de sua equivalente Haiku 5.5, confirme o erro 400, corrija-o e mova o tráfego assim que a requisição migrada for bem-sucedida. Baixe o Apidog para construir esse par de teste.
