Para usar o Claude Haiku 5.5 no Claude Code, atualize para a v2.1.293 ou posterior com claude update, depois inicie uma sessão com claude --model claude-haiku-5-5 ou execute /model claude-haiku-5-5 dentro de uma. A maior vantagem para a maioria das pessoas é executá-lo como um subagente: coloque model: haiku em um arquivo de subagente e deixe o Sonnet 5.5 ou Opus 5.5 lidar com as pesquisas, execuções de teste e resumos. Com uma chave de API, custa US$0,10/US$0,50 por milhão de tokens de entrada/saída para prompts de até 100K tokens, e US$0,50/US$2,50 acima disso.
Abaixo: configuração, a armadilha do apelido haiku, esforço, arquivos de subagentes, o degrau de preço de 100K, e quando o Sonnet ou Opus deve liderar. Para o próprio modelo, leia o que é o Claude Haiku 5.5. Se seu código chama APIs, Apidog detém os cenários de teste que um subagente Haiku pode executar para você.

Claude Haiku 5.5 no Claude Code em resumo
| Configuração | Haiku 5.5 |
|---|---|
| Versão mínima | v2.1.293 (claude update) |
| ID do Modelo | claude-haiku-5-5 |
Apelido haiku |
Haiku 5.5 apenas na API da Anthropic |
| Contexto | 1M nativo em todos os planos, sem sufixo [1m] |
| Compactação automática | Cerca de 967K tokens por padrão |
| Esforço padrão | medium (níveis de low a max) |
| Pensamento | Sempre ligado; não pode ser desligado |
| Preço da API | US$0,10/US$0,50 para prompts de até 100K tokens; US$0,50/US$2,50 acima de 100K |
| Planos | Pro, Max, Team, Enterprise ou uma chave de API; não Gratuito |
Passo 1: atualize o Claude Code
O Haiku 5.5 requer o Claude Code v2.1.293 ou posterior. A entrada do changelog o chama de "agora o modelo Haiku padrão na API da Anthropic."
claude update
O Claude Code não está disponível no plano Gratuito. Usuários gratuitos podem selecionar o Haiku 5.5 nos aplicativos Claude.ai, mas o Claude Code requer Pro, Max, Team, Enterprise ou uma chave de API da Anthropic. De acordo com claude.com/pricing, o plano Pro custa US$17 por mês cobrados anualmente ou US$20 mensalmente, e o Max começa em US$100.
Passo 2: selecione Haiku 5.5 como seu modelo principal
claude --model claude-haiku-5-5
Dentro de uma sessão em execução, /model claude-haiku-5-5 faz o mesmo. Se sua configuração model salva for haiku, uma sessão salva no Haiku 4.5 será retomada no Haiku 5.5.
O apelido haiku significa Haiku 5.5 apenas na API da Anthropic
| Provedor | haiku se resolve para |
|---|---|
| API da Anthropic | Haiku 5.5 |
| Plataforma Claude na AWS | Haiku 4.5 |
| Amazon Bedrock, Plataforma de Agentes do Google Cloud | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
Em qualquer provedor de nuvem, /model haiku e model: haiku em um arquivo de subagente lhe darão o Haiku 4.5. Fixe o ID completo lá em vez disso: claude-haiku-5-5 no Google Cloud e Claude Platform na AWS, seu nome de implantação no Foundry, e um ID de perfil de inferência como us.anthropic.claude-haiku-5-5 no Amazon Bedrock. Ou aponte o apelido para ele com ANTHROPIC_DEFAULT_HAIKU_MODEL (Passo 5).
Passo 3: escolha um nível de esforço
O Haiku 5.5 é o primeiro Haiku com controle de esforço: low, medium, high, xhigh e max, começando em medium no Claude Code.
claude --model claude-haiku-5-5 --effort high
Em uma sessão, /effort low salva um nível para o modelo atual. O guia de prompts da Anthropic sugere low para tarefas curtas de ferramentas e solicitações de alto volume, medium para a maioria do trabalho, e high para tarefas de agente mais longas. Guarde xhigh e max para trabalhos onde suas avaliações mostrem um ganho.
O pensamento permanece ligado. Você não pode desligá-lo no Haiku 5.5 no Claude Code; alwaysThinkingEnabled: false e MAX_THINKING_TOKENS=0 não têm efeito. (A API de Mensagens bruta pode desabilitá-lo em high ou abaixo.) Diminua o esforço quando quiser menos tokens de pensamento.
Passo 4: execute o Haiku 5.5 como um subagente
A Anthropic afirma que o Haiku 5.5 "combina bem com o Opus 5.5 e o Sonnet 5.5 como um subagente em trabalhos de codificação." Subagentes são arquivos Markdown com YAML frontmatter em .claude/agents/ (projeto) ou ~/.claude/agents/ (todos os projetos). Apenas name e description são obrigatórios, e a documentação de subagentes aceita sonnet, opus, haiku, fable, um ID de modelo completo, ou inherit para model. Nosso guia de subagentes aborda escopos e ferramentas.
Substitua o Explore por um explorador barato
O subagente Explore integrado executa no modelo da conversa principal, não no Haiku. Em uma sessão do Opus 5.5, cada pesquisa do Explore é executada no Opus. Um subagente de usuário ou projeto chamado Explore substitui o integrado e mantém seu próprio model:
---
name: Explore
description: Pesquisa rápida e somente leitura na base de código. Use para encontrar arquivos, símbolos e locais de chamada sem editar nada.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Você pesquisa a base de código e relata o que encontra. Retorne os caminhos dos arquivos com números de linha
e um breve resumo de cada correspondência. Nunca edite arquivos.
Salve-o como .claude/agents/Explore.md. Execute /tasks enquanto ele funciona para confirmar o modelo. Em um provedor de nuvem, troque haiku pelo ID completo do Passo 2.
Forçar todos os subagentes para o Haiku
Para executar todos os subagentes no Haiku, incluindo o Explore, defina ambas as variáveis no bloco env de um arquivo de configurações:
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL sozinho é um padrão: o campo model do próprio subagente ainda prevalece, e o Explore não muda.
Passo 5: direcione o trabalho em segundo plano para o Haiku 5.5
ANTHROPIC_DEFAULT_HAIKU_MODEL define "o modelo a ser usado para haiku, ou funcionalidade em segundo plano", como resumir sessões anteriores para claude --resume. O antigo ANTHROPIC_SMALL_FAST_MODEL está obsoleto, de acordo com a referência de variáveis de ambiente; substitua-o se o seu perfil de shell ainda o definir.
Na API da Anthropic você não precisa configurar nada. No Google Cloud, as tarefas em segundo plano usam Sonnet por padrão; no Foundry, o modelo primário; no Bedrock, Sonnet ou o modelo primário. Assim que o Haiku 5.5 estiver ativado em sua conta, fixe-o:
# Google Cloud's Agent Platform
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (inference profile ID)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
O degrau de preço de 100K em sessões longas
O preço do Haiku 5.5 depende do comprimento do prompt, e o Claude Code envia a conversa como prompt a cada turno. Assim que o contexto de uma sessão ultrapassa 100K tokens, cada solicitação é cobrada a US$0,50/US$2,50 em vez de US$0,10/US$0,50, cinco vezes a taxa de prompt curto. A documentação não menciona se os tokens em cache contam para esse limite, então faça o orçamento como se contassem.
A compactação automática não o salvará: o Haiku 5.5 compacta em cerca de 967K tokens por padrão, então uma sessão pode rodar muito acima do degrau de preço primeiro. Dois hábitos ajudam quando você paga por token:
- Compacte mais cedo.
/autocompact 100kdefine a janela mais baixa que o Claude Code aceita, para que a sessão compacte perto do limite em vez de perto de 1M. - Empurre trabalhos volumosos para subagentes. Um subagente tem seu próprio contexto, então logs de teste e resultados de pesquisa ficam fora da conversa principal.
Mesmo acima de 100K, US$0,50/US$2,50 é um quarto dos US$2/US$10 do Sonnet 5.5. Em um plano pago, as sessões usam limites de uso em vez disso, e a Anthropic não publicou como o Haiku 5.5 é contabilizado contra eles. Nosso detalhamento de preços do Haiku 5.5 explica a aritmética.
Assinantes Max e Team: os novos créditos mensais da API (US$100 no Max 5x, US$200 no Max 20x, até US$500 agrupados no Team) não cobrem o Claude Code interativo, de acordo com a documentação de créditos da API da Anthropic.
Quando manter o Sonnet 5.5 ou Opus 5.5 como líder
A Anthropic diz que Sonnet 5.5 e Opus 5.5 "permanecem as melhores escolhas para tarefas de codificação agênticas complexas." No Terminal-Bench 4.0, executado pela Anthropic no Claude Code com esforço máximo, o Haiku 5.5 obteve 39,2% contra os 70,6% do Sonnet 5.5. Os gráficos de lançamento adicionam o custo por tentativa:
| Esforço | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20,3% a US$0,68 | 28,8% a US$0,68 |
high |
24,8% a US$1,04 | 43% a US$1,46 |
max |
39,2% a US$2,64 | 70,6% a US$10,44 |
Em medium, ambos custam aproximadamente o mesmo por tentativa e o Sonnet pontua mais alto. O preço por token do Haiku não se estende para trabalhos longos de shell, então não o torne o líder para sessões de codificação difíceis.
O uso do computador conta uma história diferente. No OSWorld 2.1, o Haiku 5.5 em medium obteve 53,3% a US$0,13 por tentativa, enquanto o Sonnet 5.5 em low obteve 57,9% a US$0,68. Nosso detalhamento dos benchmarks do Haiku 5.5 tem todas as linhas, e o guia do Claude Code para Sonnet 5.5 cobre o lado do modelo líder.
Uma divisão prática: Sonnet 5.5 ou Opus 5.5 como modelo principal, Haiku 5.5 para Explore, executores de teste, leitores de log e buscadores de documentos.
Exemplo: um subagente Haiku que executa seus testes Apidog
As execuções de teste são verbosas e repetitivas, o que se encaixa bem com o Haiku. O CLI do Apidog executa seus cenários de teste Apidog salvos a partir do terminal, então um subagente pode executá-los e retornar um relatório curto enquanto o contexto do modelo principal permanece limpo.
---
name: api-test-runner
description: Executa os cenários de teste Apidog do projeto com o CLI do Apidog após a alteração de um endpoint de API, então relata as contagens de aprovação e falha com as solicitações falhas.
tools: Bash, Read
model: haiku
effort: low
---
Execute o comando de teste do CLI do Apidog documentado no README deste repositório para o
cenário que cobre o endpoint alterado. Relate as contagens de aprovação e falha.
Para cada falha, forneça o nome da solicitação, o resultado esperado e o resultado
real. Não edite código. Não tente novamente uma execução falha mais de uma vez.
A configuração para o CLI, incluindo autenticação e o comando de execução, está em CLI do Apidog no Claude Code. Baixe o Apidog para construir os cenários que o subagente executa.
Migrando um aplicativo do Haiku 4.5
Se seu aplicativo chama o Haiku 4.5 através da API, o Claude Code pode iniciar a migração:
/claude-api migrate this project to claude-haiku-5-5
Espere mudanças que quebram a compatibilidade: budget_tokens de pensamento manual, temperature ou top_p não padrão, qualquer top_k, e preenchimento automático do assistente, todos retornam um 400 no Haiku 5.5. O guia Haiku 5.5 vs Haiku 4.5 lista cada correção. Após a edição, salve a requisição antiga e nova como um par no Apidog, armazene ANTHROPIC_API_KEY como uma variável de ambiente, e faça asserções em stop_reason e usage, para que uma nova parada de refusal ou um salto nos tokens faça um teste falhar em vez de chegar à produção.
Perguntas Frequentes
O Haiku 5.5 é o modelo padrão no Claude Code? Não. É o modelo Haiku padrão na API da Anthropic, o que significa que o apelido haiku aponta para ele. Selecione-o como seu modelo principal com --model ou /model.
Posso usar o Haiku 5.5 no Claude Code no plano Gratuito? Não. O Claude Code requer um plano pago ou uma chave de API. Usuários gratuitos podem escolher o Haiku 5.5 nos aplicativos Claude.ai; veja como usar o Claude Haiku 5.5 gratuitamente.
Por que model: haiku me dá o Haiku 4.5? Você está no Bedrock, Google Cloud, Foundry ou Claude Platform na AWS, ou em uma versão anterior à v2.1.293. Fixe o ID completo ou defina ANTHROPIC_DEFAULT_HAIKU_MODEL.
Posso desativar o pensamento para economizar tokens? Não no Claude Code. Diminua o esforço em vez disso; low é a configuração mais barata.
Seu próximo passo
Execute claude update, adicione a substituição Haiku Explore e mantenha seu modelo líder atual por uma semana. Em seguida, adicione o subagente de execução de testes se seu projeto tiver APIs. Para chamar o modelo de seu próprio código, comece com o guia da API do Haiku 5.5. O Apidog é gratuito para começar e oferece testes reais para o subagente executar.
