A Anthropic lançou o Claude Sonnet 5 em 30 de junho de 2026, e ele muda a forma de pensar sobre a seleção de modelos. Em tarefas de agente e uso de ferramentas, o Sonnet 5 fica a poucos pontos do Opus 4.8, enquanto custa muito menos por token. Essa diferença, uma pequena diferença de qualidade contra uma grande diferença de preço, é toda a decisão. Este guia oferece uma tabela comparativa, os números de benchmark relatados e uma lista de verificação de decisão para que você possa escolher o modelo certo por carga de trabalho, em vez de usar o mais caro por padrão. Ambos os modelos expõem a mesma forma de API HTTP, para que você possa testá-los com seus próprios prompts antes de se comprometer. Apidog é um bom lugar para salvar essas solicitações, trocar o ID do modelo e comparar as respostas lado a lado.
A resposta curta
Escolha o Sonnet 5 ao construir agentes, executar ciclos de ferramentas ou lidar com alto volume onde o custo é importante. É o modelo Sonnet mais voltado para agentes até agora, e seu desempenho se aproxima do Opus 4.8 nas tarefas que os agentes realmente executam.

Escolha o Opus 4.8 quando precisar do raciocínio mais complexo, da autonomia de longo prazo ou da mais alta qualidade absoluta, e o orçamento permitir. O Opus ainda se destaca quando o modelo não tem nada externo em que se apoiar e precisa raciocinar do zero.
Para a maioria do tráfego de produção, o Sonnet 5 é o padrão sensato e o Opus 4.8 é o caminho de escalonamento para a pequena parcela de solicitações que precisam dele.
Comparação lado a lado
Aqui está como os dois modelos se alinham nas especificações e preços que impulsionam a decisão.
| Atributo | Claude Sonnet 5 | Claude Opus 4.8 |
|---|---|---|
| ID do Modelo | claude-sonnet-5 |
claude-opus-4-8 |
| Janela de contexto | 1.000.000 tokens | 1.000.000 tokens |
| Saída máxima | 128.000 tokens | 128.000 tokens |
| Preço de entrada (padrão) | $3 / milhão de tokens | $5 / milhão de tokens |
| Preço de saída (padrão) | $15 / milhão de tokens | $25 / milhão de tokens |
| Preço de entrada introdutório | $2 / milhão (até 31 de agosto de 2026) | padrão |
| Preço de saída introdutório | $10 / milhão (até 31 de agosto de 2026) | padrão |
| Pensamento adaptativo | Ativado por padrão | Suportado |
| Parâmetro de esforço | baixo / médio / alto / altíssimo | Suportado |
| Posicionamento | Sonnet mais voltado para agentes, melhor velocidade + inteligência | Raciocínio superior, qualidade máxima |
A janela de contexto e a saída máxima são idênticas, então nenhum dos modelos se destaca em capacidade bruta. A verdadeira divisão está no preço e onde cada modelo é mais forte.
Em termos de preço, o Sonnet 5 supera o Opus 4.8 por uma ampla margem. Nas taxas padrão, a entrada do Sonnet 5 é 60% da do Opus 4.8 (US$ 3 vs US$ 5) e sua saída é 60% da do Opus 4.8 (US$ 15 vs US$ 25). Durante o período introdutório, até 31 de agosto de 2026, o Sonnet 5 é ainda mais barato, a US$ 2 / US$ 10, o que o leva a cerca de 40% do preço de entrada do Opus 4.8 e 40% do seu preço de saída. Para um modelo de custo completo, consulte o detalhamento de preços do Claude Sonnet 5 e o guia de preços do Opus 4.8.
Uma ressalva importante: o Sonnet 5 usa um novo tokenizador que produz aproximadamente 30% mais tokens para o mesmo texto de entrada. As taxas por token são mais baixas que as do Opus, mas a contagem de tokens para texto equivalente é maior, então modele suas cargas de trabalho reais com a contagem de tokens em vez de assumir uma economia percentual fixa.
O que os benchmarks dizem
Os números abaixo são relatados no lançamento. Eles vêm dos benchmarks de lançamento da Anthropic e são corroborados em artigos de lançamento. Trate-os como figuras relatadas, não como testes independentes.
| Benchmark | Sonnet 5 | Opus 4.8 | Diferença |
|---|---|---|---|
| SWE-bench Pro (codificação por agente) | 63.2% | 69.2% | 6.0 pts |
| Terminal-Bench 2.1 | 80.4% | 82.7% | 2.3 pts |
| OSWorld-Verified (uso de computador) | 81.2% | 83.4% | 2.2 pts |
O padrão é consistente. Quando ferramentas estão em uso, trabalho de terminal e uso de computador, o Sonnet 5 fica dentro de 1 a 3 pontos do Opus 4.8. No SWE-bench Pro, que exige um raciocínio sustentado mais intenso em uma tarefa de codificação, a diferença aumenta para cerca de 6 pontos.
Essa é a principal percepção para os compradores. Dê ao modelo ferramentas, um terminal, um navegador, uma API para chamar, e o Sonnet 5 tem um desempenho próximo ao do Opus. Retire as ferramentas e force o raciocínio puro, e o Opus ganha seu prêmio. A Anthropic descreve o Sonnet 5 como mais forte em tarefas de agente e ferramentas do que em raciocínio puro, e os benchmarks confirmam isso.
Para uma análise aprofundada completa dos benchmarks e o que esses testes não abordam, leia o detalhamento dos benchmarks do Claude Sonnet 5. Você também pode verificar os números da Anthropic no hub de transparência da Anthropic.
Quando escolher o Claude Sonnet 5
O Sonnet 5 é a escolha certa nestas situações.
- Você está construindo um agente. Agentes chamam ferramentas e APIs em um loop, e é exatamente aí que o Sonnet 5 se aproxima do Opus. O desempenho da ferramenta próximo ao Opus aparece em execuções reais de agentes.
- Você executa alto volume. A 60% do preço por token do Opus 4.8, ou 40% durante o período introdutório, as economias se acumulam rapidamente em milhões de solicitações.
- Você é sensível a custos. Se suas margens dependem do custo de inferência, o preço do Sonnet 5 oferece a maior parte da capacidade do Opus por menos.
- Você precisa de velocidade. A Anthropic posiciona o Sonnet 5 como a melhor combinação de velocidade e inteligência, o que é importante para cargas de trabalho interativas e com restrição de latência.
- Você usa o Sonnet 4.6 hoje. O Sonnet 5 é uma atualização "drop-in"; mude o ID do modelo e revise algumas alterações de comportamento. Veja Sonnet 5 vs Sonnet 4.6 para os detalhes da migração.
Quando o Opus 4.8 justifica seu preço premium
O Opus 4.8 vale o preço mais alto nestes casos.
- A tarefa é de raciocínio puro e difícil. Análises complexas, matemática de várias etapas ou planejamento onde o modelo não pode se apoiar em ferramentas externas é onde a vantagem de 6 pontos do Opus aparece.
- Você precisa de autonomia de longo prazo. Tarefas que são executadas por um longo tempo sem checkpoints humanos se beneficiam do raciocínio mais forte do Opus e da menor taxa de comportamento desalinhado.
- A qualidade não é negociável. Para a pequena parcela de solicitações onde a melhor resposta possível justifica o custo, o Opus 4.8 é o topo da linha atual do Opus.
- Você precisa da maior margem de segurança em contextos de agente. O Opus 4.8 apresenta taxas de comportamento desalinhado mais baixas do que o Sonnet 5 na auditoria de comportamento automatizada da Anthropic.
Se você quiser a imagem completa do Opus, leia o que é o Claude Opus 4.8. Para uma visão mais ampla entre fornecedores, veja Opus 4.8 vs GPT-5.5 vs Gemini 3.5.
Uma lista de verificação de decisão
Responda a estas perguntas em ordem. O primeiro "sim" aponta para um modelo.
- Esta é uma tarefa de raciocínio puro e difícil, sem ferramentas envolvidas? Se sim, e a qualidade é mais importante que o custo, escolha o Opus 4.8.
- A tarefa é executada autonomamente por um longo tempo sem revisão humana? Se sim, incline-se para o Opus 4.8.
- Esta é uma carga de trabalho de agente ou de ciclo de ferramentas? Se sim, escolha o Sonnet 5. Ele tem um desempenho próximo ao do Opus aqui com menor custo.
- Este é um volume alto ou sensível a custos? Se sim, escolha o Sonnet 5.
- Nenhuma das opções acima, uma carga de trabalho geral? Padronize para o Sonnet 5 e escale solicitações específicas para o Opus 4.8 quando a qualidade for insuficiente.
Um padrão comum de produção é rotear a maior parte do tráfego para o Sonnet 5 e reservar o Opus 4.8 para as solicitações que não atingem um padrão de qualidade. Você obtém a maior parte da economia de custos, mantendo um teto de qualidade para os casos mais difíceis.
Você não está preso a um único modelo. Ambos compartilham a janela de contexto, o limite de saída e a forma da API, então rotear entre eles é uma questão de trocar o ID do modelo por solicitação.
Como os dois se comparam ao Fable 5
Para contextualizar, o modelo mais capaz e amplamente lançado da Anthropic é o Fable 5 (claude-fable-5) a US$ 10 / US$ 50 por milhão de tokens. Isso é o dobro do preço do Opus 4.8 e mais que o triplo da taxa padrão do Sonnet 5. O Fable 5 está acima de ambos os modelos para o trabalho mais exigente.
A imagem de três camadas: Sonnet 5 para trabalho eficiente em custos, de agente e de alto volume, Opus 4.8 para raciocínio difícil e qualidade superior, e Fable 5 para a fronteira. Para uma comparação direta relacionada, veja Fable 5 vs Opus 4.8.
Teste ambos com seus próprios prompts usando o Apidog
Benchmarks são um ponto de partida, não um veredito para sua carga de trabalho. A maneira honesta de escolher é executar seus prompts reais contra ambos os modelos e comparar custo, latência e qualidade de saída nas tarefas que realmente lhe interessam.

Como o Sonnet 5 e o Opus 4.8 compartilham a mesma forma de API Anthropic Messages, alternar entre eles é um único campo. Aqui está uma solicitação mínima que você pode enviar para qualquer um dos modelos alterando o valor de model.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Summarize the tradeoffs of choosing Sonnet 5 over Opus 4.8 for an API agent."}
]
}'
Para executar o mesmo teste contra o Opus 4.8, mude "model": "claude-sonnet-5" para "model": "claude-opus-4-8" e envie novamente.
É aqui que o Apidog ajuda. Você pode salvar ambas as solicitações em uma coleção, armazenar sua chave de API como uma variável de ambiente para que ela nunca esteja no corpo da solicitação, e alternar entre um ambiente Sonnet 5 e um ambiente Opus 4.8 com um clique. Adicione uma asserção para verificar a forma da resposta ou stop_reason, e então execute a coleção para comparar ambos os modelos na mesma entrada. Quando você quiser construir contra uma resposta fixa antes de gastar tokens reais, o servidor mock do Apidog retorna um payload substituto para que seu código de integração tenha algo para acessar.
Se você estiver comparando lado a lado em muitos prompts, salve cada prompt como uma solicitação na coleção e execute-os como um cenário de teste. Você obtém uma comparação reproduzível em vez de chamadas manuais únicas. Para acompanhar, Baixe o Apidog e importe as duas solicitações acima.
Um detalhe da API a ter em mente ao testar: no Sonnet 5, parâmetros de amostragem como temperature, top_p e top_k retornam um erro 400 se definidos para um valor não padrão, e o pensamento estendido manual com budget_tokens é removido. Direcione o comportamento através do prompt do sistema e do parâmetro de esforço. Para o passo a passo prático da API, veja como usar a API do Claude Sonnet 5.
FAQ
O Claude Sonnet 5 é melhor que o Opus 4.8? Não em todos os aspectos. Em tarefas de agente e uso de ferramentas, o Sonnet 5 fica dentro de 1 a 3 pontos do Opus 4.8 a um preço muito mais baixo, o que o torna um valor melhor para esse trabalho. Em raciocínio puro e difícil, o Opus 4.8 lidera por cerca de 6 pontos. Escolha por carga de trabalho, em vez de declarar um universalmente melhor.
Quanto mais barato é o Sonnet 5 que o Opus 4.8? Nas taxas padrão, o Sonnet 5 custa US$ 3 / US$ 15 por milhão de tokens de entrada/saída, contra US$ 5 / US$ 25 do Opus 4.8, ou seja, cerca de 60% do preço do Opus. Durante o período introdutório, até 31 de agosto de 2026, o Sonnet 5 cai para US$ 2 / US$ 10, aproximadamente 40% do preço do Opus. Note que o novo tokenizador do Sonnet 5 produz cerca de 30% mais tokens para o mesmo texto, então meça sua carga de trabalho real com a contagem de tokens. Veja o detalhamento de preços para o cálculo completo.
O Sonnet 5 e o Opus 4.8 têm a mesma janela de contexto? Sim. Ambos oferecem uma janela de contexto de 1.000.000 tokens e uma saída máxima de 128.000 tokens. A diferença é o preço e a força do raciocínio, não a capacidade.
Posso alternar entre o Sonnet 5 e o Opus 4.8 sem mudar meu código? Quase completamente. Ambos usam a API Anthropic Messages, então a troca é uma questão de mudar o valor de model de claude-sonnet-5 para claude-opus-4-8. Fique atento às diferenças de comportamento específicas do modelo e lembre-se de que o Sonnet 5 rejeita parâmetros de amostragem não padrão com um erro 400.
Qual modelo devo usar para construir agentes? O Sonnet 5 para a maioria dos trabalhos de agente. Agentes executam em ciclos de ferramentas, e é aí que o Sonnet 5 tem um desempenho mais próximo ao do Opus 4.8, custando muito menos. Escale para o Opus 4.8 para as etapas específicas que exigem o raciocínio mais difícil.
