Claude Haiku 5.5 vs Haiku 4.5: O Que Mudou e os Breaking Changes a Priorizar

Haiku 5.5 versus Haiku 4.5: 90% mais barato para até 100 mil tokens, 1 milhão de contexto, e cinco breaking changes que retornam erros 400. Correções de JSON antes/depois incluídas.

Medy Evrard

8 outubro 2026

Claude Haiku 5.5 vs Haiku 4.5: O Que Mudou e os Breaking Changes a Priorizar

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

O Claude Haiku 5.5 (claude-haiku-5-5, lançado em 7 de outubro de 2026) custa 90% menos que o Haiku 4.5 para prompts de até 100K tokens ($0.10/$0.50 por milhão de tokens de entrada/saída vs $1/$5), possui uma janela de contexto de 1M tokens em vez de 200K, e pontua muito mais alto em todos os benchmarks de lançamento que listam ambos. A ressalva: cinco formatos de requisição que funcionavam no 4.5 agora retornam um erro 400, e várias outras mudanças alteram respostas e custos sem erro.

Abaixo: uma tabela comparativa, cada mudança disruptiva com JSON antes/depois, as mudanças silenciosas e um plano de teste para Apidog. Para a folha de especificações completa, leia o que é Claude Haiku 5.5. Se você ainda está usando o modelo mais antigo, nosso guia da API Claude Haiku 4.5 o aborda.

button

Haiku 4.5 vs Haiku 5.5: um panorama

Claude Haiku 4.5 Claude Haiku 5.5
ID do Modelo (API Claude) claude-haiku-4-5-20251001 claude-haiku-5-5
Contexto / saída máxima 200K / 64K 1M / 128K
Entrada / saída por MTok $1 / $5 $0.10 / $0.50 para prompts de até 100K tokens; $0.50 / $2.50 acima
Leitura de cache / escrita de 5m por MTok $0.10 / $1.25 $0.01 / $0.125 até 100K; $0.05 / $0.625 acima
Entrada / saída em lote por MTok $0.50 / $2.50 $0.05 / $0.25 até 100K; $0.25 / $1.25 acima
Processamento Manual budget_tokens Adaptativo apenas, ativado por padrão
Níveis de esforço Nenhum baixo, médio (padrão), alto, xalto, máximo
Prompt mínimo armazenável em cache 4.096 tokens 512 tokens
Tokenizador Mais antigo Cerca de 30% mais tokens para o mesmo texto
Parâmetros de amostragem não padrão, pré-preenchimento Aceito erro 400
Nível de Prioridade Suportado Não suportado
Status Ativo, desativação não antes de 15 de outubro de 2026 Ativo, desativação não antes de 7 de outubro de 2027

O Haiku 4.5 não está depreciado. A página de depreciação de modelos o lista como Ativo sem data de depreciação, então você pode migrar no seu próprio cronograma. Os limites de taxa são os mesmos em ambos.

As cinco mudanças disruptivas

Cada uma retorna um erro 400 no Haiku 5.5 para um corpo que funciona no 4.5. O guia de migração do Haiku 5.5 lista todas elas.

1. Processamento manual com budget_tokens

O Haiku 5.5 executa apenas processamento adaptativo. Um orçamento fixo é rejeitado.

// Antes (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classifique este ticket." }]
}

// Depois (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classifique este ticket." }]
}

O esforço é agora a alavanca: onde o 4.5 usava um orçamento pequeno, escolha um esforço menor. Você ainda pode enviar thinking: {"type": "disabled"}, mas apenas com esforço alto ou inferior; em xhigh ou max, isso também resulta em um erro 400.

2. Parâmetros de amostragem

Remova temperature, top_p e top_k. Os únicos valores aceitos são temperature: 1 e top_p: 0.99. Qualquer outro valor resulta em um erro 400, incluindo top_p: 1, qualquer top_k, e o envio de temperature e top_p juntos.

// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extraia o ID do pedido." }] }

// Depois (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extraia o ID do pedido." }] }

Se você usava uma temperatura baixa para uma saída consistente, mova essa intenção para o prompt.

3. Pré-preenchimento do assistente

Uma última vez do assistente para o modelo continuar é rejeitada, mesmo com o processamento desativado. Termine as messages com uma vez do usuário.

// Antes (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Retorne o sentimento como JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// Depois (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Responda apenas com um objeto JSON. Sem preâmbulo.",
  "messages": [
    { "role": "user", "content": "Retorne o sentimento como JSON." }
  ] }

Para formatos estritos, o guia de migração aponta para saídas estruturadas ou uma ferramenta com campos enum para classificação.

4. Uso de computador: de computer_20250124 para computer_toolset_20260801

Na API Claude e no Google Cloud, o Haiku 5.5 suporta o uso de computador apenas através do novo conjunto de ferramentas. Remova o cabeçalho beta computer-use-2025-01-24 e remova fine-grained-tool-streaming-2025-05-14 se você o enviar, pois ele resulta em um erro 400 junto com um conjunto de ferramentas.

// Antes (Haiku 4.5, cabeçalho anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Abra a página de configurações." }] }

// Depois (Haiku 5.5, sem cabeçalho beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Abra a página de configurações." }] }

Seu loop de agente também muda: despache em name e toolset_name de cada bloco tool_use em vez de input.action, e ecoe toolset_name nos resultados. O Haiku 5.5 também inclui a ferramenta de uso do navegador (browser_toolset_20260801), que o Haiku 4.5 não suporta. Veja uso de computador no Claude Code para uma visão mais ampla.

5. Edição de turnos anteriores antes de um bloco de processamento

Um bloco de processamento do Haiku 5.5 permanece válido apenas enquanto tudo o que foi enviado antes dele não for alterado. Altere system, tools ou uma mensagem anterior e reenvie o bloco, e você receberá um erro 400. O Haiku 4.5 nunca executou essa verificação. Aqui, o turno 1 enviou "system": "Você é um agente de cobrança." e o turno 2 o edita.

// Antes: sistema editado + bloco de processamento reproduzido = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "Você é um agente de cobrança. Seja breve.",
  "messages": [
    { "role": "user", "content": "Por que fui cobrado duas vezes?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Verificando." } ] },
    { "role": "user", "content": "Pedido 4412." }
  ] }

// Depois: turnos anteriores inalterados, nova instrução anexada
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "Você é um agente de cobrança.",
  "messages": [
    { "role": "user", "content": "Por que fui cobrado duas vezes?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Verificando." } ] },
    { "role": "user", "content": "Pedido 4412. Seja breve." }
  ] }

Em contas criadas antes de 31 de agosto de 2026, 00:00 UTC, o erro aparece apenas em requisições que definem thinking.block_binding.prefix_mismatch_behavior.

Mudanças silenciosas que não gerarão um erro

O que melhorou

Estes são números reportados pela Anthropic com o Haiku 5.5 no esforço máximo; a Artificial Analysis executou o GDPval-AA e o AA-Briefcase independentemente.

Benchmark Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, offline subset 15.7% 72.4%
Humanity’s Last Exam, with tools 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Multilingual 67.4% 83.7%
Chartography, no tools 6.4% 46.4%

A execução do Terminal-Bench do Haiku 4.5 usou um orçamento fixo de 63.999 tokens para o processamento. Com o esforço médio padrão, o Haiku 5.5 obteve 1277 no GDPval-AA, ainda bem acima do 4.5. A Box relatou pontuações 11 pontos mais altas que o Haiku 4.5 com cerca de metade da latência. As tabelas completas estão em benchmarks do Claude Haiku 5.5.

A Anthropic ainda posiciona o Sonnet 5.5 e o Opus 5.5 como melhores escolhas para codificação agêntica complexa. O Haiku 5.5 visa classificação, extração, sumarização, compactação, subagentes e uso de navegador.

Em termos de custo, a Anthropic afirma que o Haiku 5.5 é cerca de 75% mais barato em média. Esse número combina preços 90% mais baixos para até 100K tokens e 50% mais baixos acima, e já compensa os tokens extras do novo tokenizador. O prompt de sistema de uso de ferramenta também encolheu, de 496 para 286 tokens com a escolha de ferramenta auto. Exemplos trabalhados estão em preços do Claude Haiku 5.5.

Teste a migração no Apidog

No Apidog, crie um projeto com três requisições salvas para https://api.anthropic.com/v1/messages:

  1. Linha de base: seu corpo atual do Haiku 4.5. Afirme o status 200.
  2. Corpo antigo, novo modelo: altere apenas model para claude-haiku-5-5. Afirme o status 400. Mantenha uma cópia para cada mudança disruptiva que você encontrar.
  3. Migrado: o corpo corrigido. Afirme o status 200, um stop_reason que não seja recusa ou max_tokens, e um bloco de texto encontrado por type.

Armazene ANTHROPIC_API_KEY como uma variável de ambiente e referencie-a como {{ANTHROPIC_API_KEY}} no cabeçalho x-api-key, com anthropic-version: 2023-06-01. Compare usage.input_tokens entre as requisições de linha de base e migradas para ver a mudança do tokenizador em seus próprios prompts. Salve o conjunto como um cenário de teste, e um colega de equipe que reintroduzir temperature falhará a execução em vez da produção. Os fundamentos da requisição estão em como usar a API Claude Haiku 5.5.

Se você trabalha no Claude Code, /claude-api migrate this project to claude-haiku-5-5 aplica a troca de ID do modelo e as correções de parâmetros, e então lhe fornece uma lista de verificação. Observe que o alias haiku resolve para Haiku 5.5 apenas na API da Anthropic; veja Claude Haiku 5.5 no Claude Code.

Perguntas Frequentes

O Claude Haiku 4.5 está depreciado? Não. Ele está listado como Ativo sem data de depreciação, e sua desativação não é antes de 15 de outubro de 2026.

Por que minha requisição Haiku 4.5 retorna um erro 400 no Haiku 5.5? Verifique por budget_tokens, temperature/top_p/top_k, um pré-preenchimento do assistente, computer_20250124, ou edições em turnos anteriores antes de um bloco de processamento. Essas são as cinco mudanças disruptivas.

O Haiku 5.5 é mais barato que o Haiku 4.5 para prompts longos? Sim. Acima de 100K tokens, ele custa $0.50/$2.50 por milhão, metade do $1/$5 do Haiku 4.5. O Haiku 4.5 não consegue processar prompts além de 200K.

Devo mudar tudo para o Haiku 5.5? Para classificação, extração e trabalho de subagentes, teste-o primeiro e depois faça a mudança. Compare-o com seu rival mais próximo em Haiku 5.5 vs GPT-6 Luna.

Próximo passo

Salve sua requisição Haiku 4.5 ao lado de sua equivalente Haiku 5.5, confirme o erro 400, corrija-o e mova o tráfego assim que a requisição migrada for bem-sucedida. Baixe o Apidog para construir esse par de teste.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs