O Que é Claude Opus 5? Especificações, Benchmarks e Preço

Claude Opus 5 explicado: o lançamento em julho de 2026, ID do modelo, contexto de 1M, corte de dados de maio de 2026, preços de $5/$25 versus Fable 5, as alegações de benchmark da Anthropic, e o teto honesto.

Ashley Innocent

Ashley Innocent

25 julho 2026

O Que é Claude Opus 5? Especificações, Benchmarks e Preço

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

Claude Opus 5 é o modelo mais recente de nível Opus da Anthropic, lançado em 24 de julho de 2026. A Anthropic o posiciona para codificação agentic complexa e trabalho empresarial, e a documentação agora o nomeia como o ponto de partida padrão: se você não tem certeza de qual modelo usar, comece com Claude Opus 5. O número principal é o preço. O Opus 5 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, a mesma taxa do Opus 4.8 e metade do que o Fable 5 cobra.

Este guia abrange as especificações, a relação preço-desempenho, os benchmarks de lançamento da Anthropic e quanto peso dar a eles, as duas alterações de API que quebram o código existente do Opus 4.8, onde você pode executar o modelo e o limite que a Anthropic apresenta. Se você chamar o modelo via HTTP, poderá enviar e inspecionar essas solicitações no Apidog enquanto avança.

button

Claude Opus 5 em resumo

Especificação Valor
ID do modelo da API claude-opus-5 (sem sufixo de data)
Lançamento 24 de julho de 2026
Janela de contexto 1.000.000 tokens, padrão e máximo
Saída máxima 128.000 tokens na API de Mensagens; 300.000 na API de Lote com o cabeçalho beta output-300k-2026-03-24
Preço base US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída
Corte de conhecimento Maio de 2026
Pensamento adaptativo Ativado por padrão
Níveis de esforço low, medium, high, xhigh, max; padrão high
Nível de Prioridade Não suportado
Disponibilidade API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform no AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Três dessas linhas merecem uma segunda olhada.

A janela de contexto de 1M é tanto o padrão quanto o máximo, e não precisa de cabeçalho beta. Também não há prêmio para contexto longo, então um prompt de 900.000 tokens é cobrado pela mesma taxa por token que um prompt de 900 tokens.

O corte de conhecimento de maio de 2026 é o mais recente de qualquer modelo Claude atual. Fable 5 e Sonnet 5 ambos estão em janeiro de 2026, então Opus 5 conhece aproximadamente quatro meses extras de bibliotecas, lançamentos e mudanças de API sem que você precise colá-los.

O Nível de Prioridade é o único recurso que regrediu. O Opus 4.8 o suporta; o Opus 5 não. Se o planejamento de capacidade da sua empresa depende do Nível de Prioridade, essa é uma restrição real e é abordada no guia de migração.

Para a tabela completa do modelo e cada campo verbatim, a visão geral dos modelos da Anthropic é a fonte de registro.

O que é Claude Opus 5

Opus 5 é o sucessor de Claude Opus 4.8. O ID do modelo da API é a string exata claude-opus-5. No Amazon Bedrock, o ID é anthropic.claude-opus-5, e no Google Cloud é claude-opus-5 novamente. A Claude Platform no AWS usa o ID próprio.

Claude Opus 5 comparado com outros modelos Claude.

O nível Opus sempre foi a linha "peso-pesado" da Anthropic, situando-se acima do Sonnet e abaixo dos modelos de pesquisa de ponta Fable e Mythos. O que mudou com o Opus 5 é que o nível deixou de ser a opção cara para a qual você escalava. A documentação da Anthropic agora diz para você começar aqui, o que é uma postura diferente da geração 4.x, onde o Sonnet era o padrão e o Opus era a atualização.

O modelo também está se tornando o padrão para assinantes Max e o modelo de maior desempenho disponível no Pro, sendo a primeira vez que um modelo da classe Opus é o teto para um plano de consumidor de preço médio. O artigo caminhos gratuitos e pagos mais baratos detalha o que isso realmente oferece.

A história do preço-desempenho

Esta é a parte com a qual todos os artigos de lançamento começaram, e ela se mantém quando você olha para a página de preços.

Taxa Entrada (por M tokens) Saída (por M tokens)
Padrão US$ 5,00 US$ 25,00
API de Lote (50% de desconto) US$ 2,50 US$ 12,50
Modo Rápido (prévia de pesquisa) US$ 10,00 US$ 50,00
Gravação em cache, TTL de 5 minutos US$ 6,25 n/a
Gravação em cache, TTL de 1 hora US$ 10,00 n/a
Acertos e atualizações de cache US$ 0,50 n/a

Claude Fable 5 cobra US$ 10 e US$ 50. O Opus 5 cobra US$ 5 e US$ 25 por um modelo que a Anthropic afirma estar a meio por cento do Fable 5 em codificação agentic. Essa é a proposta: saída de classe de ponta pela metade do preço de ponta.

Alguns fatores menos óbvios estão dentro dessa tabela. O mínimo de cache de prompt caiu para 512 tokens, abaixo dos 1.024 no Opus 4.8, então os prompts de sistema que antes eram muito curtos para cache agora são armazenados em cache sem nenhuma alteração de código. Os acertos de cache custam US$ 0,50 por milhão, um décimo da taxa de entrada base. A API de Lote reduz tudo pela metade para trabalhos que podem esperar. E a sobrecarga do prompt de sistema de uso de ferramentas é ligeiramente mais barata que a 4.8, em 286 tokens para escolha de ferramenta auto ou none versus 290 no Opus 4.8 e 675 no Opus 4.7.

Dois detalhes de custo pegam as pessoas de surpresa. O modo rápido dobra a taxa para US$ 10 e US$ 50 em troca de aproximadamente 2,5x a velocidade de saída, e ele só funciona na API própria: não no Bedrock, não no Google Cloud, não no Microsoft Foundry e não com a API de Lote. Separadamente, definir inference_geo: "us" aplica um multiplicador de 1.1x em todas as categorias de tokens, então a inferência fixada nos EUA é uma sobretaxa de 10% na entrada, saída, gravações de cache e acertos de cache.

A análise completa de preços explora exemplos de custo por tarefa, e se você já está cortando gastos, os recursos em cortar sua conta da API Claude ainda se aplicam. A página de preços da Anthropic é a tabela oficial.

O que a Anthropic diz que os benchmarks mostram

Cada número abaixo é da própria Anthropic, publicado com o lançamento. Em 25 de julho de 2026, nenhum deles foi reproduzido independentemente. Leia-os como afirmações do fornecedor, não como medições neutras, e planeje executar suas próprias avaliações antes de comprometer uma carga de trabalho de produção.

Benchmark Afirmação da Anthropic
Frontier-Bench v0.1 Supera todos os outros modelos e mais do que dobra a pontuação do Opus 4.8, com um custo menor por tarefa
ARC-AGI 3 Aproximadamente 3x a pontuação do segundo melhor modelo
OSWorld 2.0 (uso de computador) Supera o Fable 5 a um terço do custo
CursorBench 3.2 (codificação agentic) Dentro de 0,5% do pico do Fable 5, pela metade do preço
Zapier AutomationBench Taxa de aprovação aproximadamente 1,5x a do segundo melhor modelo
Química orgânica +10,2 pontos sobre o Opus 4.8
Análise de proteínas +7,7 pontos sobre o Opus 4.8

O formato das alegações é consistente: grandes saltos em avaliações agentic e baseadas em ferramentas, e um argumento de custo por tarefa anexado a quase todas elas. Os resultados do CursorBench e OSWorld são os dois que mais importam para a decisão de compra, porque são eles que dizem que você pode migrar do Fable 5 para o Opus 5 sem perder muito.

São também os dois que mais precisam da sua própria verificação. Uma diferença de meio por cento em um benchmark de codificação escolhido por um fornecedor está bem dentro da faixa onde sua base de código, seu prompt e suas definições de ferramentas decidem o resultado. O mergulho profundo nos benchmarks aborda o que cada avaliação realmente mede e o que testar por si mesmo.

O limite honesto

Opus 5 não é o topo da pilha Claude, e a Anthropic não afirma que seja.

Fable 5 mantém a designação de "modelo amplamente lançado mais capaz". E em duas capacidades de pesquisa específicas, exploração de cibersegurança e pesquisa autônoma em biologia, o Opus 5 ainda fica atrás do Mythos 5. A Anthropic declara isso diretamente em seu próprio material de lançamento, o que vale a pena notar, dado como a cobertura convencional enquadrou o lançamento.

Então, o resumo preciso é mais restrito do que as manchetes: capacidade de classe de ponta pela metade do preço de ponta, com duas capacidades nomeadas onde um modelo superior ainda vence. Para a maioria da codificação agentic e automação empresarial, esse limite nunca aparece. Para pesquisa de segurança ou trabalho científico autônomo, ele aparece. O contexto sobre o nível de pesquisa está no explicador do modelo de classe Mythos e Fable 5 vs Mythos 5.

Duas mudanças que quebram o código do Opus 4.8

Trocar o ID do modelo não é suficiente. Duas mudanças irão impactar sua primeira requisição.

O "pensamento" está ativado por padrão. No Opus 4.8, uma requisição sem o campo thinking era executada sem "pensar". No Opus 5, essa mesma requisição executa o "pensamento adaptativo". Como max_tokens ainda limita os tokens de "pensamento" mais o texto da resposta juntos, uma carga de trabalho que dimensionava max_tokens de forma apertada em torno de sua saída esperada agora pode ser truncada no meio da resposta. Nada gera erro. A saída simplesmente é cortada, o que é o pior tipo de regressão para depurar.

A desativação do "pensamento" é limitada ao nível de esforço high. Enviar thinking: {type: "disabled"} junto com o esforço xhigh ou max retorna um erro 400, imposto por requisição. Se você tinha uma configuração que desativava o pensamento e aumentava o esforço, cada chamada falhará imediatamente.

Há mais na superfície de migração: os níveis de esforço foram recalibrados, então seus resultados de varredura antigos não são mais transferíveis, o cabeçalho beta da janela de contexto sumiu, as mensagens de sistema no meio da conversa agora são aceitas onde o 4.8 as rejeitava com um 400, e o Nível de Prioridade desapareceu. O guia de migração do Opus 4.8 para o Opus 5 tem os trechos antes e depois para cada um, e o guia de migração da Anthropic é a referência principal. Se você ainda está na geração anterior, o passo a passo da API do Opus 4.8 mostra de onde você está migrando.

O parâmetro de esforço, não um interruptor

A maioria das notícias de lançamento descreveu o Opus 5 como permitindo que os usuários alternassem entre custo e capacidade. Essa abordagem aponta para um parâmetro de API real: output_config.effort.

O esforço possui cinco níveis, de low a max, e o padrão é high. Ele controla o quanto o modelo "pensa" antes de responder, o que por sua vez controla o que você gasta. As interfaces de usuário expõem isso como um seletor de esforço, e não como um parâmetro bruto, mas é o mesmo controle por baixo.

Duas coisas mudaram nesta geração. Os níveis foram recalibrados, então a Anthropic recomenda explicitamente executar uma nova varredura de esforço em vez de transferir suas configurações do Opus 4.8. E low e medium são significativamente mais fortes no Opus 5 do que em qualquer modelo Opus anterior, o que os torna utilizáveis para trabalho real pela primeira vez, em vez de serem as configurações que você evita. Para loops de codificação e agentic, xhigh continua sendo o ponto de partida recomendado.

O guia do parâmetro de esforço aborda todos os cinco níveis, como executar uma varredura em suas próprias avaliações e a interação com max_tokens.

Como o Opus 5 se comporta de forma diferente

O guia de prompting da Anthropic para o Opus 5 documenta mudanças de comportamento que alterarão seus resultados, mesmo que seu código seja idêntico.

Existe um modo de falha que vale a pena conhecer. Com o pensamento desativado, dois artefatos aparecem ocasionalmente: chamadas de ferramentas escritas como texto simples que nunca são executadas, e tags XML internas aparecendo na saída visível. Em um loop agentic, o texto vazado pode contaminar as próximas interações. A própria mitigação da Anthropic é manter o pensamento ativado e controlar o custo com um nível de esforço mais baixo. O mergulho profundo em prompting tem snippets de copiar e colar para cada mudança, e o guia Claude Code os aplica a fluxos de trabalho de editor.

Onde você pode executá-lo

Superfície Status
API Claude Disponível, ID do modelo claude-opus-5
claude.ai Disponível; padrão para Max, modelo principal para Pro
Claude Code Disponível
Claude Cowork Disponível
Amazon Bedrock Disponível como anthropic.claude-opus-5
Claude Platform no AWS Disponível, ID próprio
Google Cloud Disponível como claude-opus-5
Microsoft Foundry Disponível
GitHub Copilot Disponível

O modo rápido é a exceção a essa matriz. Ele funciona apenas na API própria, então uma implantação no Bedrock ou Google Cloud não pode alcançá-lo.

Testando requisições do Opus 5 no Apidog

Chamar o Opus 5 significa atingir um endpoint HTTP com cabeçalhos de autenticação, um corpo JSON, respostas em streaming e erros que você precisa reproduzir. O Apidog gerencia essa parte: envie a requisição, salve-a em uma coleção, mantenha sua chave de API em uma variável de ambiente em vez de colá-la no corpo, e leia a resposta campo por campo.

Interface Apidog mostrando como testar chamadas do Claude Opus 5

Uma configuração prática para este modelo:

  1. Armazene ANTHROPIC_API_KEY como uma variável de ambiente para que a chave nunca vá para uma coleção compartilhada.
  2. Salve uma requisição de Mensagens de linha de base e depois duplique-a por nível de esforço para que você possa comparar low, high e xhigh lado a lado no mesmo prompt.
  3. Observe o fluxo SSE diretamente quando você ativar o streaming, para que possa ver onde uma resposta truncada realmente parou.
  4. Leia o bloco usage em cada resposta para confirmar que os acertos de cache estão ocorrendo e para ver quantos tokens de "pensamento" a requisição consumiu.

Aqui está a requisição de linha de base:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
    ]
  }'

Essa requisição executa o pensamento adaptativo, porque o pensamento está ativado por padrão e nenhum campo thinking está presente. Dê a max_tokens espaço real: 1.024 era suficiente no Opus 4.8 e será truncado aqui. Para acompanhar, baixe o Apidog e importe a requisição. O guia passo a passo da API aborda streaming, uso de ferramentas e leitura de usage em sua totalidade.

Quem deve usar o Claude Opus 5

Use o Opus 5 quando:

Mantenha-se onde está quando:

FAQ

Qual é o ID do modelo para Claude Opus 5? É a string exata claude-opus-5, sem sufixo de data. No Amazon Bedrock, use anthropic.claude-opus-5; Google Cloud e Claude Platform no AWS usam claude-opus-5.

Quanto custa o Claude Opus 5? US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, idêntico ao Opus 4.8 e metade do valor de US$ 10 e US$ 50 do Fable 5. A API de Lote o reduz pela metade novamente para US$ 2,50 e US$ 12,50. O modo rápido o dobra para US$ 10 e US$ 50.

O Claude Opus 5 é melhor que o Fable 5? Pelos próprios números da Anthropic, ele está próximo, não à frente. A Anthropic relata que o Opus 5 está dentro de 0,5% do Fable 5 no CursorBench 3.2 e à frente no OSWorld 2.0 com um terço do custo, mas o Fable 5 mantém a designação de "modelo amplamente lançado mais capaz". Esses são resultados executados pelo fornecedor, sem reprodução independente ainda.

Qual é a janela de contexto no Claude Opus 5? 1.000.000 de tokens, tanto como padrão quanto como máximo, sem cabeçalho beta e sem prêmio de preço para contexto longo. A saída máxima é de 128.000 tokens na API de Mensagens, ou 300.000 na API de Lote com o cabeçalho beta output-300k-2026-03-24.

Preciso alterar meu código para atualizar do Opus 4.8? Além do ID do modelo, sim. O "pensamento" agora é executado por padrão, então revise max_tokens ou corra o risco de truncamento silencioso. E thinking: {type: "disabled"} combinado com esforço xhigh ou max retorna um 400. Reexecute também sua varredura de esforço, já que os níveis foram recalibrados.

Qual é o corte de conhecimento do Claude Opus 5? Maio de 2026 para conhecimento confiável e dados de treinamento, o mais recente de qualquer modelo Claude atual.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs