Claude Opus 5 x Sonnet 5: Qual te atende melhor?

Claude Opus 5 vs Sonnet 5 comparados pelo custo real por tarefa: US$ 5/US$ 25 contra a taxa de lançamento do Sonnet de US$ 2/US$ 10 que sobe para US$ 3/US$ 15 em 1º de setembro de 2026, além de especificações, benchmarks e uma tabela de decisão por carga de trabalho.

INEZA Felin-Michel

INEZA Felin-Michel

25 julho 2026

Claude Opus 5 x Sonnet 5: Qual te atende melhor?

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

A Anthropic lançou Claude Opus 5 em 24 de julho de 2026, e Claude Sonnet 5 em 30 de junho de 2026. Ambos são de geração atual. Ambos possuem uma janela de contexto de 1M e saída máxima de 128k. Ambos executam pensamento adaptativo por padrão e expõem um parâmetro de esforço. De fora, eles parecem ser o mesmo modelo com dois preços, o que transforma a escolha em uma questão puramente de gasto.

Essa questão tem um prazo. O Sonnet 5 ainda está com sua taxa introdutória de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. Em 1º de setembro de 2026, ele passará para o padrão de US$ 3 / US$ 15. O Opus 5 custa US$ 5 / US$ 25 e não está programado para mudar. Assim, a diferença entre os níveis é de 2,5x hoje e aproximadamente 1,67x a partir de setembro, e essa mudança é grande o suficiente para alterar decisões reais. Se você está orçando uma carga de trabalho que será lançada no quarto trimestre, orce-a com os números de setembro, não os de hoje.

Este guia compara os dois em especificações, custo real por tarefa (não custo por token, o que engana aqui), onde a vantagem de codificação de agente do Opus 5 vale a pena pagar, e onde o Sonnet 5 é claramente suficiente. Se você quiser medir a diferença por si mesmo em vez de confiar em uma tabela, você pode executar ambos os modelos lado a lado no Apidog e ler os campos usage de volta.

A imagem de preços e a data que a muda

Aqui estão as taxas básicas publicadas na página de preços da Anthropic.

Modelo Entrada / MTok Saída / MTok Status
Claude Opus 5 US$ 5,00 US$ 25,00 Padrão
Claude Sonnet 5 (até 31 de agosto de 2026) US$ 2,00 US$ 10,00 Introdutório
Claude Sonnet 5 (a partir de 1º de setembro de 2026) US$ 3,00 US$ 15,00 Padrão

O Opus 5 também possui taxas que valem a pena conhecer antes de modelar qualquer coisa: cache de prompt a US$ 6,25 por MTok para uma gravação de 5 minutos, US$ 10 para uma gravação de 1 hora, e US$ 0,50 para acertos de cache; a API de Lote a US$ 2,50 / US$ 12,50, um desconto fixo de 50%; modo rápido a US$ 10 / US$ 50 para 2,5x de velocidade de saída (prévia de pesquisa, apenas API de primeira parte, não combinável com lote); e um multiplicador de 1,1x em cada categoria de token quando você define inference_geo: "us". O detalhamento completo com exemplos práticos está no guia de preços do Opus 5, e o lado do Sonnet é coberto no detalhamento de preços do Sonnet 5.

Um detalhe que surpreende as pessoas: o Opus 5 custa exatamente o que o Opus 4.8 custava. A Anthropic não aumentou o preço do Opus para um salto de geração. Assim, a decisão Opus-versus-Sonnet que você tomou em julho de 2026 é a mesma aritmética que você estava fazendo em junho, com um Opus melhor de um lado.

Especificações: invólucros quase idênticos

Especificação Claude Opus 5 Claude Sonnet 5
ID do Modelo claude-opus-5 claude-sonnet-5
Janela de Contexto 1M tokens (padrão e máximo) 1M tokens (padrão e máximo)
Saída Máxima 128k (300k na API de Lote com cabeçalho beta) 128k
Pensamento Adaptativo Ligado por padrão Ligado por padrão
Níveis de Esforço Cinco, até max, padrão high low / medium / high / xhigh
Corte de Conhecimento Maio de 2026 Janeiro de 2026
Nível de Prioridade Não suportado Não disponível
Cache de Prompt, uso de ferramentas, lote, visão Suportado Suportado
Tokenizador Tokenizador de geração 4.7 Tokenizador de geração 4.7

Três dessas linhas realizam um trabalho real.

A diferença no corte de conhecimento é de quatro meses. O Opus 5 é treinado até maio de 2026, o corte mais recente de qualquer modelo Claude atual; o Sonnet 5 para em janeiro de 2026. Se sua carga de trabalho envolve versões de bibliotecas ou alterações de API da primavera de 2026, o Opus 5 as conhece. Isso é um argumento de recenticidade em vez de capacidade, e a recuperação fecha essa lacuna para ambos os modelos.

Nenhum dos níveis oferece o Nível de Prioridade. Isso confunde equipes que migram do Opus 4.8, que o suporta. Se você depende do Nível de Prioridade para garantias de latência, nenhum modelo de geração atual é um substituto direto. O guia de migração do Opus 4.8 para o Opus 5 aborda o restante das mudanças que quebram a compatibilidade.

A linha do tokenizador é uma não-diferença, e isso vale a pena saber. É a linha que as pessoas esperam que importe aqui, e não importa.

Por que o custo por token ainda engana aqui

Comece esclarecendo uma confusão comum. A Anthropic documenta que os modelos Claude 4.7 e posteriores usam um tokenizador mais novo que produz aproximadamente 30% mais tokens para o mesmo texto do que o anterior. Tanto o Opus 5 quanto o Sonnet 5 estão nesse grupo. O valor de 30% é medido em relação ao Sonnet 4.6 e anteriores, não entre estes dois.

Assim, Opus 5 e Sonnet 5 contam seu texto da mesma forma. Um documento de 4.000 palavras tem o mesmo número de tokens de entrada cobráveis em ambos, e os preços por token publicados são diretamente comparáveis. Se você está migrando do Sonnet 4.6, orce para o salto de 30%; se você está escolhendo entre estes dois, ignore-o.

O que move o custo por tarefa é o volume de saída. A própria orientação de prompt da Anthropic para o Opus 5 diz que suas respostas visíveis padrão e entregáveis escritos são mais longos do que os modelos Opus anteriores, e que a diminuição do esforço reduz o pensamento sem encurtar de forma confiável a resposta visível. Tokens de saída custam cinco vezes mais do que tokens de entrada em ambos os modelos. Uma solicitação do Opus 5 que escreve 30% mais prosa do que você pediu é um item real na linha de custo, e a correção está no prompt, não no preço. O guia de prompt do Opus 5 aborda as instruções de concisão que o reduzem novamente.

O endpoint de contagem de tokens da Anthropic fornece contagens exatas de entrada para ambos os modelos em seu próprio texto em alguns minutos. Meça a saída em uma amostra real de sua carga de trabalho, em vez de assumir.

Aqui está como a aritmética se parece em uma carga de trabalho diária concreta: 500k tokens de entrada e 40k tokens de saída.

Cenário Custo diário Proporção vs Sonnet 5
Opus 5 US$ 3,50 linha de base
Sonnet 5, introdutório (US$ 2/US$ 10) US$ 1,40 Opus é 2.5x
Sonnet 5, padrão a partir de 1º de setembro (US$ 3/US$ 15) US$ 2,10 Opus é 1.67x
Opus 5 escrevendo 30% mais saída do que o solicitado US$ 3,80 Opus é 1.81x

Essa última linha é a que se deve atentar. A verbosidade que você não pediu pode custar mais do que a diferença de nível pela qual você se angustiou, e é a coisa mais barata nesta página para corrigir.

E então há a matemática da tentativa, que é onde toda a comparação geralmente se decide. Com preços padrão, uma execução do Opus 5 custa US$ 3,50 e uma execução do Sonnet 5 custa US$ 2,10. Se o Sonnet 5 precisar de uma segunda tentativa em uma tarefa que o Opus 5 completa em uma, as duas execuções custam US$ 4,20 e o Sonnet se torna a opção mais cara. As retentativas do modelo e o tempo de revisão humana, não apenas os tokens. As alavancas gerais para ambos os modelos estão em nosso guia para reduzir sua conta da API Claude.

Onde o Opus 5 justifica o preço premium

Os números de lançamento da Anthropic para o Opus 5 são agressivos. Para deixar claro o seu status: estes são resultados executados pelo fornecedor e publicados pela Anthropic, e até 25 de julho de 2026, nenhum deles foi reproduzido de forma independente. Leia-os como afirmações com uma fonte, não como medições neutras.

Os próprios números de lançamento do Sonnet 5 ficaram abaixo do Opus 4.8: SWE-bench Pro 63,2% contra 69,2%, Terminal-Bench 2.1 a 80,4% contra 82,7%, e OSWorld-Verified 81,2% contra 83,4%. A história do Sonnet 5 era que ele ficava a poucos pontos do Opus 4.8 em trabalho de agente e uso de ferramentas, custando muito menos, o que era uma história forte em junho. O Opus 5 muda a forma: o nível acima do Sonnet agora é materialmente melhor do que o Opus 4.8 com o qual essas comparações do Sonnet foram feitas. A atribuição completa e os avisos estão no detalhamento dos benchmarks do Opus 5 e na postagem dos benchmarks do Sonnet 5.

Na prática, o Opus 5 se destaca quando a tarefa possui uma ou mais destas propriedades:

Onde o Sonnet 5 é claramente suficiente

A resposta honesta para a maioria do tráfego de produção é o Sonnet 5. O fato de o Opus 5 ser melhor não torna o Sonnet 5 insuficiente, e pagar por uma capacidade que você não consegue detectar em sua saída não é uma estratégia.

O Sonnet 5 é a escolha certa quando:

Há também um caminho gratuito que vale a pena conhecer: o Sonnet 5 é o modelo padrão no plano Claude gratuito, então você pode verificar sua saída em seus prompts reais antes de escrever uma linha de código. O Opus 5 é agora o modelo de maior desempenho disponível para assinantes Pro e o padrão para Max, então os níveis de consumidor também o alcançam. Nosso guia de acesso gratuito ao Opus 5 mostra os caminhos honestos.

Tabela de decisão por carga de trabalho

Carga de Trabalho Escolha Por que
Refatoração de múltiplos arquivos ou migração em um loop de agente Opus 5 Erros compostos tornam a confiabilidade por etapa o custo dominante
Classificação ou extração de alto volume Sonnet 5 Ambos atingem o teto de qualidade; o preço vence
Chat voltado para o cliente com recuperação Sonnet 5 A recuperação fecha a lacuna do corte; a latência importa
Uso de computador ou automação de desktop Opus 5 A lacuna do OSWorld 2.0 da Anthropic é a afirmação de agente mais clara
Processamento em lote de documentos durante a noite Sonnet 5, ou Opus 5 na API de Lote Lote com 50% de desconto pode colocar o Opus 5 perto da taxa padrão do Sonnet
Revisão de segurança ou código crítico para produção Opus 5 O custo de uma falha supera a diferença de token
Análise científica ou quantitativa Opus 5 Os deltas de química e análise de proteínas são os ganhos mais fortes
Prototipagem e ferramentas internas Sonnet 5 Meça antes de fazer o upgrade
Qualquer coisa que exija conhecimento de primavera de 2026 sem recuperação Opus 5 Corte de maio de 2026 versus janeiro de 2026
UX interativa sensível à latência Sonnet 5 Ou Opus 5 em modo rápido a US$ 10/US$ 50 se a profundidade for inegociável

Observe a linha da API de Lote. O Opus 5 em lote custa US$ 2,50 / US$ 12,50, o que fica abaixo da taxa padrão de setembro do Sonnet 5 de US$ 3 / US$ 15 na entrada e ligeiramente acima na saída. Se seu trabalho tolera processamento assíncrono, a questão do nível pode se dissolver completamente.

O que nenhum dos modelos é

O Opus 5 não está no topo da pilha do Claude, e vale a pena dizer isso claramente, em vez de deixar que a cobertura de lançamento implique o contrário. O Fable 5 continua sendo o modelo mais capaz e amplamente lançado da Anthropic, a US$ 10 / US$ 50. E o Opus 5 ainda fica atrás do Mythos 5 em exploração de segurança cibernética e pesquisa de biologia autônoma, o que é uma declaração da própria Anthropic, não uma crítica externa.

A forma precisa de enquadrar o Opus 5 é capacidade de classe de fronteira pela metade do preço de fronteira, com um teto nomeado acima dele. Se sua carga de trabalho atinge esse teto, a comparação real não é Opus 5 contra Sonnet 5; veja Opus 5 vs Fable 5 em vez disso.

Execute a comparação você mesmo no Apidog

Benchmarks são a carga de trabalho de outra pessoa. A comparação que importa são seus prompts, suas ferramentas, seus critérios de aceitação. Ambos os modelos estão por trás do mesmo endpoint de Mensagens, então testá-los um contra o outro é uma questão de mudar uma string.

Configure-o no Apidog assim:

  1. Crie uma solicitação para o endpoint de Mensagens da Anthropic e armazene a chave da API como uma variável de ambiente em vez de colá-la no corpo.
  2. Salve duas variantes compartilhando o mesmo prompt, uma com "model": "claude-opus-5" e outra com "model": "claude-sonnet-5".
  3. Leia o objeto usage em cada resposta. Contagens reais de tokens de entrada, saída e em cache por modelo são a única entrada confiável para um modelo de custo.
  4. Adicione asserções na forma da resposta para que uma recusa ou uma resposta truncada falhe ruidosamente em vez de silenciosamente.
  5. Repita a solicitação do Opus 5 em diferentes níveis de output_config.effort e compare o custo com a qualidade. O Opus 5 assume o padrão high, e seus níveis low e medium são significativamente mais fortes do que nos modelos Opus anteriores, então uma varredura geralmente encontra uma configuração mais barata que ainda passa. O guia do parâmetro de esforço aborda o método.
curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {"role": "user", "content": "Refactor this handler to use async I/O."}
    ]
  }'

Duas armadilhas enquanto você testa. O pensamento adaptativo está ativado por padrão em ambos os modelos, e max_tokens limita o pensamento mais a resposta juntos, então um orçamento que funcionou em um modelo mais antigo pode truncar. E no Opus 5, combinar thinking: {type: "disabled"} com o esforço xhigh ou max retorna um 400. Baixe o Apidog para executar o par lado a lado, e veja o passo a passo da API do Opus 5 para o fluxo de solicitação completo.

Perguntas Frequentes

O Claude Opus 5 vale 2,5x o preço do Sonnet 5? Para codificação de agente de longo prazo, uso de computador e trabalho que é caro para errar, sim. Para classificação, extração e chat de alto volume, geralmente não. E o múltiplo é de apenas 2,5x até 1º de setembro de 2026, após o qual a taxa padrão do Sonnet 5 de US$ 3 / US$ 15 o torna cerca de 1,67x.

Quando o preço do Claude Sonnet 5 muda? A taxa introdutória de US$ 2 / US$ 10 vai até 31 de agosto de 2026. A partir de 1º de setembro de 2026, ela passa para US$ 3 / US$ 15. O Opus 5 permanece em US$ 5 / US$ 25.

O Opus 5 e o Sonnet 5 tokenizam o texto de forma diferente? Não. Ambos usam o tokenizador de geração 4.7, então o texto idêntico produz contagens de tokens de entrada idênticas e os preços por token são diretamente comparáveis. O aumento de aproximadamente 30% de tokens que a Anthropic documenta é medido em relação ao Sonnet 4.6 e modelos anteriores, o que importa se você está atualizando de um desses, não se você está escolhendo entre estes dois. Compare o custo por tarefa concluída de qualquer forma, já que o comprimento da saída e as tentativas movem a conta mais do que a diferença de preço de tabela.

Posso alternar entre Opus 5 e Sonnet 5 sem alterações de código? Principalmente. Ambos adotam o pensamento adaptativo por padrão e rejeitam parâmetros de amostragem não padrão. As diferenças a serem observadas são os níveis de esforço (Opus 5 expõe um nível max e o padrão é high) e o 400 específico do Opus quando o pensamento é desabilitado em xhigh ou max.

Qual modelo a Anthropic recomenda por padrão? A própria documentação da Anthropic agora diz para começar com o Claude Opus 5 se você estiver em dúvida. Essa é uma recomendação, não uma análise de custo. Comece por lá e, em seguida, meça se o Sonnet 5 oferece o mesmo resultado por menos. A comparação mais antiga Sonnet 5 vs Opus 4.8 ainda é um pano de fundo útil sobre como os níveis se comportam em relação uns aos outros.

Para as especificações completas, atribuições de benchmark e matriz de disponibilidade, comece em o que é Claude Opus 5, e leia a postagem de lançamento do Opus 5 e a visão geral dos modelos da Anthropic para as fontes primárias.

botão

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs