A Anthropic lançou Claude Opus 5 em 24 de julho de 2026, e Claude Sonnet 5 em 30 de junho de 2026. Ambos são de geração atual. Ambos possuem uma janela de contexto de 1M e saída máxima de 128k. Ambos executam pensamento adaptativo por padrão e expõem um parâmetro de esforço. De fora, eles parecem ser o mesmo modelo com dois preços, o que transforma a escolha em uma questão puramente de gasto.
Essa questão tem um prazo. O Sonnet 5 ainda está com sua taxa introdutória de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. Em 1º de setembro de 2026, ele passará para o padrão de US$ 3 / US$ 15. O Opus 5 custa US$ 5 / US$ 25 e não está programado para mudar. Assim, a diferença entre os níveis é de 2,5x hoje e aproximadamente 1,67x a partir de setembro, e essa mudança é grande o suficiente para alterar decisões reais. Se você está orçando uma carga de trabalho que será lançada no quarto trimestre, orce-a com os números de setembro, não os de hoje.

Este guia compara os dois em especificações, custo real por tarefa (não custo por token, o que engana aqui), onde a vantagem de codificação de agente do Opus 5 vale a pena pagar, e onde o Sonnet 5 é claramente suficiente. Se você quiser medir a diferença por si mesmo em vez de confiar em uma tabela, você pode executar ambos os modelos lado a lado no Apidog e ler os campos usage de volta.
A imagem de preços e a data que a muda
Aqui estão as taxas básicas publicadas na página de preços da Anthropic.
| Modelo | Entrada / MTok | Saída / MTok | Status |
|---|---|---|---|
| Claude Opus 5 | US$ 5,00 | US$ 25,00 | Padrão |
| Claude Sonnet 5 (até 31 de agosto de 2026) | US$ 2,00 | US$ 10,00 | Introdutório |
| Claude Sonnet 5 (a partir de 1º de setembro de 2026) | US$ 3,00 | US$ 15,00 | Padrão |
O Opus 5 também possui taxas que valem a pena conhecer antes de modelar qualquer coisa: cache de prompt a US$ 6,25 por MTok para uma gravação de 5 minutos, US$ 10 para uma gravação de 1 hora, e US$ 0,50 para acertos de cache; a API de Lote a US$ 2,50 / US$ 12,50, um desconto fixo de 50%; modo rápido a US$ 10 / US$ 50 para 2,5x de velocidade de saída (prévia de pesquisa, apenas API de primeira parte, não combinável com lote); e um multiplicador de 1,1x em cada categoria de token quando você define inference_geo: "us". O detalhamento completo com exemplos práticos está no guia de preços do Opus 5, e o lado do Sonnet é coberto no detalhamento de preços do Sonnet 5.
Um detalhe que surpreende as pessoas: o Opus 5 custa exatamente o que o Opus 4.8 custava. A Anthropic não aumentou o preço do Opus para um salto de geração. Assim, a decisão Opus-versus-Sonnet que você tomou em julho de 2026 é a mesma aritmética que você estava fazendo em junho, com um Opus melhor de um lado.
Especificações: invólucros quase idênticos
| Especificação | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| ID do Modelo | claude-opus-5 |
claude-sonnet-5 |
| Janela de Contexto | 1M tokens (padrão e máximo) | 1M tokens (padrão e máximo) |
| Saída Máxima | 128k (300k na API de Lote com cabeçalho beta) | 128k |
| Pensamento Adaptativo | Ligado por padrão | Ligado por padrão |
| Níveis de Esforço | Cinco, até max, padrão high |
low / medium / high / xhigh |
| Corte de Conhecimento | Maio de 2026 | Janeiro de 2026 |
| Nível de Prioridade | Não suportado | Não disponível |
| Cache de Prompt, uso de ferramentas, lote, visão | Suportado | Suportado |
| Tokenizador | Tokenizador de geração 4.7 | Tokenizador de geração 4.7 |
Três dessas linhas realizam um trabalho real.
A diferença no corte de conhecimento é de quatro meses. O Opus 5 é treinado até maio de 2026, o corte mais recente de qualquer modelo Claude atual; o Sonnet 5 para em janeiro de 2026. Se sua carga de trabalho envolve versões de bibliotecas ou alterações de API da primavera de 2026, o Opus 5 as conhece. Isso é um argumento de recenticidade em vez de capacidade, e a recuperação fecha essa lacuna para ambos os modelos.
Nenhum dos níveis oferece o Nível de Prioridade. Isso confunde equipes que migram do Opus 4.8, que o suporta. Se você depende do Nível de Prioridade para garantias de latência, nenhum modelo de geração atual é um substituto direto. O guia de migração do Opus 4.8 para o Opus 5 aborda o restante das mudanças que quebram a compatibilidade.
A linha do tokenizador é uma não-diferença, e isso vale a pena saber. É a linha que as pessoas esperam que importe aqui, e não importa.
Por que o custo por token ainda engana aqui
Comece esclarecendo uma confusão comum. A Anthropic documenta que os modelos Claude 4.7 e posteriores usam um tokenizador mais novo que produz aproximadamente 30% mais tokens para o mesmo texto do que o anterior. Tanto o Opus 5 quanto o Sonnet 5 estão nesse grupo. O valor de 30% é medido em relação ao Sonnet 4.6 e anteriores, não entre estes dois.
Assim, Opus 5 e Sonnet 5 contam seu texto da mesma forma. Um documento de 4.000 palavras tem o mesmo número de tokens de entrada cobráveis em ambos, e os preços por token publicados são diretamente comparáveis. Se você está migrando do Sonnet 4.6, orce para o salto de 30%; se você está escolhendo entre estes dois, ignore-o.
O que move o custo por tarefa é o volume de saída. A própria orientação de prompt da Anthropic para o Opus 5 diz que suas respostas visíveis padrão e entregáveis escritos são mais longos do que os modelos Opus anteriores, e que a diminuição do esforço reduz o pensamento sem encurtar de forma confiável a resposta visível. Tokens de saída custam cinco vezes mais do que tokens de entrada em ambos os modelos. Uma solicitação do Opus 5 que escreve 30% mais prosa do que você pediu é um item real na linha de custo, e a correção está no prompt, não no preço. O guia de prompt do Opus 5 aborda as instruções de concisão que o reduzem novamente.
O endpoint de contagem de tokens da Anthropic fornece contagens exatas de entrada para ambos os modelos em seu próprio texto em alguns minutos. Meça a saída em uma amostra real de sua carga de trabalho, em vez de assumir.
Aqui está como a aritmética se parece em uma carga de trabalho diária concreta: 500k tokens de entrada e 40k tokens de saída.
| Cenário | Custo diário | Proporção vs Sonnet 5 |
|---|---|---|
| Opus 5 | US$ 3,50 | linha de base |
| Sonnet 5, introdutório (US$ 2/US$ 10) | US$ 1,40 | Opus é 2.5x |
| Sonnet 5, padrão a partir de 1º de setembro (US$ 3/US$ 15) | US$ 2,10 | Opus é 1.67x |
| Opus 5 escrevendo 30% mais saída do que o solicitado | US$ 3,80 | Opus é 1.81x |
Essa última linha é a que se deve atentar. A verbosidade que você não pediu pode custar mais do que a diferença de nível pela qual você se angustiou, e é a coisa mais barata nesta página para corrigir.
E então há a matemática da tentativa, que é onde toda a comparação geralmente se decide. Com preços padrão, uma execução do Opus 5 custa US$ 3,50 e uma execução do Sonnet 5 custa US$ 2,10. Se o Sonnet 5 precisar de uma segunda tentativa em uma tarefa que o Opus 5 completa em uma, as duas execuções custam US$ 4,20 e o Sonnet se torna a opção mais cara. As retentativas do modelo e o tempo de revisão humana, não apenas os tokens. As alavancas gerais para ambos os modelos estão em nosso guia para reduzir sua conta da API Claude.
Onde o Opus 5 justifica o preço premium
Os números de lançamento da Anthropic para o Opus 5 são agressivos. Para deixar claro o seu status: estes são resultados executados pelo fornecedor e publicados pela Anthropic, e até 25 de julho de 2026, nenhum deles foi reproduzido de forma independente. Leia-os como afirmações com uma fonte, não como medições neutras.
- Frontier-Bench v0.1: Opus 5 supera todos os outros modelos e mais do que dobra a pontuação do Opus 4.8, com um custo por tarefa mais baixo.
- ARC-AGI 3: aproximadamente 3x a pontuação do segundo melhor modelo.
- OSWorld 2.0: supera o Fable 5 a cerca de um terço do custo.
- CursorBench 3.2: dentro de 0,5% do pico do Fable 5, pela metade do preço.
- Zapier AutomationBench: taxa de aprovação cerca de 1,5x maior que a do segundo melhor modelo.
- Ciência: química orgânica subiu 10,2 pontos e análise de proteínas subiu 7,7 pontos em relação ao Opus 4.8.
Os próprios números de lançamento do Sonnet 5 ficaram abaixo do Opus 4.8: SWE-bench Pro 63,2% contra 69,2%, Terminal-Bench 2.1 a 80,4% contra 82,7%, e OSWorld-Verified 81,2% contra 83,4%. A história do Sonnet 5 era que ele ficava a poucos pontos do Opus 4.8 em trabalho de agente e uso de ferramentas, custando muito menos, o que era uma história forte em junho. O Opus 5 muda a forma: o nível acima do Sonnet agora é materialmente melhor do que o Opus 4.8 com o qual essas comparações do Sonnet foram feitas. A atribuição completa e os avisos estão no detalhamento dos benchmarks do Opus 5 e na postagem dos benchmarks do Sonnet 5.
Na prática, o Opus 5 se destaca quando a tarefa possui uma ou mais destas propriedades:
- Codificação de agente de longo prazo. Refatorações de múltiplos arquivos, migrações e loops que executam dezenas de chamadas de ferramentas. Erros se acumulam em loops de agente, e um modelo que falha com menos frequência por etapa vale mais do que sua diferença de preço sugere.
- A tarefa é cara para errar. Migrações de produção, código relacionado à segurança, qualquer coisa que um humano precise revisar cuidadosamente. O tempo de revisão custa mais por hora do que qualquer modelo custa por dia.
- Uso de computador e automação de desktop. OSWorld 2.0 é o benchmark em que a Anthropic mais se apoiou aqui.
- Raciocínio científico e analítico complexo, onde os deltas de química e análise de proteínas são os ganhos mais claros no conjunto de lançamento, ou trabalho que precisa de conhecimento de maio de 2026 que você não pode fornecer por meio de recuperação.
Onde o Sonnet 5 é claramente suficiente
A resposta honesta para a maioria do tráfego de produção é o Sonnet 5. O fato de o Opus 5 ser melhor não torna o Sonnet 5 insuficiente, e pagar por uma capacidade que você não consegue detectar em sua saída não é uma estratégia.
O Sonnet 5 é a escolha certa quando:
- O volume é alto e cada chamada é pequena. Classificação, extração, sumarização, marcação, roteamento. O teto de qualidade nessas tarefas é baixo o suficiente para que ambos os modelos o atinjam.
- A saída é validada automaticamente de qualquer forma. Se uma verificação de esquema ou um conjunto de testes detecta falhas a baixo custo, uma taxa de falha ligeiramente maior é uma taxa de falha barata.
- A latência importa mais que a profundidade, ou você ainda está prototipando. Construa com o Sonnet 5, então meça se o Opus 5 muda algo antes de pagar por ele.
Há também um caminho gratuito que vale a pena conhecer: o Sonnet 5 é o modelo padrão no plano Claude gratuito, então você pode verificar sua saída em seus prompts reais antes de escrever uma linha de código. O Opus 5 é agora o modelo de maior desempenho disponível para assinantes Pro e o padrão para Max, então os níveis de consumidor também o alcançam. Nosso guia de acesso gratuito ao Opus 5 mostra os caminhos honestos.
Tabela de decisão por carga de trabalho
| Carga de Trabalho | Escolha | Por que |
|---|---|---|
| Refatoração de múltiplos arquivos ou migração em um loop de agente | Opus 5 | Erros compostos tornam a confiabilidade por etapa o custo dominante |
| Classificação ou extração de alto volume | Sonnet 5 | Ambos atingem o teto de qualidade; o preço vence |
| Chat voltado para o cliente com recuperação | Sonnet 5 | A recuperação fecha a lacuna do corte; a latência importa |
| Uso de computador ou automação de desktop | Opus 5 | A lacuna do OSWorld 2.0 da Anthropic é a afirmação de agente mais clara |
| Processamento em lote de documentos durante a noite | Sonnet 5, ou Opus 5 na API de Lote | Lote com 50% de desconto pode colocar o Opus 5 perto da taxa padrão do Sonnet |
| Revisão de segurança ou código crítico para produção | Opus 5 | O custo de uma falha supera a diferença de token |
| Análise científica ou quantitativa | Opus 5 | Os deltas de química e análise de proteínas são os ganhos mais fortes |
| Prototipagem e ferramentas internas | Sonnet 5 | Meça antes de fazer o upgrade |
| Qualquer coisa que exija conhecimento de primavera de 2026 sem recuperação | Opus 5 | Corte de maio de 2026 versus janeiro de 2026 |
| UX interativa sensível à latência | Sonnet 5 | Ou Opus 5 em modo rápido a US$ 10/US$ 50 se a profundidade for inegociável |
Observe a linha da API de Lote. O Opus 5 em lote custa US$ 2,50 / US$ 12,50, o que fica abaixo da taxa padrão de setembro do Sonnet 5 de US$ 3 / US$ 15 na entrada e ligeiramente acima na saída. Se seu trabalho tolera processamento assíncrono, a questão do nível pode se dissolver completamente.
O que nenhum dos modelos é
O Opus 5 não está no topo da pilha do Claude, e vale a pena dizer isso claramente, em vez de deixar que a cobertura de lançamento implique o contrário. O Fable 5 continua sendo o modelo mais capaz e amplamente lançado da Anthropic, a US$ 10 / US$ 50. E o Opus 5 ainda fica atrás do Mythos 5 em exploração de segurança cibernética e pesquisa de biologia autônoma, o que é uma declaração da própria Anthropic, não uma crítica externa.
A forma precisa de enquadrar o Opus 5 é capacidade de classe de fronteira pela metade do preço de fronteira, com um teto nomeado acima dele. Se sua carga de trabalho atinge esse teto, a comparação real não é Opus 5 contra Sonnet 5; veja Opus 5 vs Fable 5 em vez disso.
Execute a comparação você mesmo no Apidog
Benchmarks são a carga de trabalho de outra pessoa. A comparação que importa são seus prompts, suas ferramentas, seus critérios de aceitação. Ambos os modelos estão por trás do mesmo endpoint de Mensagens, então testá-los um contra o outro é uma questão de mudar uma string.

Configure-o no Apidog assim:
- Crie uma solicitação para o endpoint de Mensagens da Anthropic e armazene a chave da API como uma variável de ambiente em vez de colá-la no corpo.
- Salve duas variantes compartilhando o mesmo prompt, uma com
"model": "claude-opus-5"e outra com"model": "claude-sonnet-5". - Leia o objeto
usageem cada resposta. Contagens reais de tokens de entrada, saída e em cache por modelo são a única entrada confiável para um modelo de custo. - Adicione asserções na forma da resposta para que uma recusa ou uma resposta truncada falhe ruidosamente em vez de silenciosamente.
- Repita a solicitação do Opus 5 em diferentes níveis de
output_config.efforte compare o custo com a qualidade. O Opus 5 assume o padrãohigh, e seus níveislowemediumsão significativamente mais fortes do que nos modelos Opus anteriores, então uma varredura geralmente encontra uma configuração mais barata que ainda passa. O guia do parâmetro de esforço aborda o método.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"messages": [
{"role": "user", "content": "Refactor this handler to use async I/O."}
]
}'
Duas armadilhas enquanto você testa. O pensamento adaptativo está ativado por padrão em ambos os modelos, e max_tokens limita o pensamento mais a resposta juntos, então um orçamento que funcionou em um modelo mais antigo pode truncar. E no Opus 5, combinar thinking: {type: "disabled"} com o esforço xhigh ou max retorna um 400. Baixe o Apidog para executar o par lado a lado, e veja o passo a passo da API do Opus 5 para o fluxo de solicitação completo.
Perguntas Frequentes
O Claude Opus 5 vale 2,5x o preço do Sonnet 5? Para codificação de agente de longo prazo, uso de computador e trabalho que é caro para errar, sim. Para classificação, extração e chat de alto volume, geralmente não. E o múltiplo é de apenas 2,5x até 1º de setembro de 2026, após o qual a taxa padrão do Sonnet 5 de US$ 3 / US$ 15 o torna cerca de 1,67x.
Quando o preço do Claude Sonnet 5 muda? A taxa introdutória de US$ 2 / US$ 10 vai até 31 de agosto de 2026. A partir de 1º de setembro de 2026, ela passa para US$ 3 / US$ 15. O Opus 5 permanece em US$ 5 / US$ 25.
O Opus 5 e o Sonnet 5 tokenizam o texto de forma diferente? Não. Ambos usam o tokenizador de geração 4.7, então o texto idêntico produz contagens de tokens de entrada idênticas e os preços por token são diretamente comparáveis. O aumento de aproximadamente 30% de tokens que a Anthropic documenta é medido em relação ao Sonnet 4.6 e modelos anteriores, o que importa se você está atualizando de um desses, não se você está escolhendo entre estes dois. Compare o custo por tarefa concluída de qualquer forma, já que o comprimento da saída e as tentativas movem a conta mais do que a diferença de preço de tabela.
Posso alternar entre Opus 5 e Sonnet 5 sem alterações de código? Principalmente. Ambos adotam o pensamento adaptativo por padrão e rejeitam parâmetros de amostragem não padrão. As diferenças a serem observadas são os níveis de esforço (Opus 5 expõe um nível max e o padrão é high) e o 400 específico do Opus quando o pensamento é desabilitado em xhigh ou max.
Qual modelo a Anthropic recomenda por padrão? A própria documentação da Anthropic agora diz para começar com o Claude Opus 5 se você estiver em dúvida. Essa é uma recomendação, não uma análise de custo. Comece por lá e, em seguida, meça se o Sonnet 5 oferece o mesmo resultado por menos. A comparação mais antiga Sonnet 5 vs Opus 4.8 ainda é um pano de fundo útil sobre como os níveis se comportam em relação uns aos outros.
Para as especificações completas, atribuições de benchmark e matriz de disponibilidade, comece em o que é Claude Opus 5, e leia a postagem de lançamento do Opus 5 e a visão geral dos modelos da Anthropic para as fontes primárias.
