Claude Fable 5.1 vs Fable 5: O Que Mudou e Vale a Pena Atualizar?

Claude Fable 5.1 vs Fable 5: mesmo preço, leituras de cache reduzidas para US$0.25, cada delta de benchmark, 3 quebras de compatibilidade, perda do Nível de Prioridade e uma regra de decisão por carga de trabalho.

INEZA Felin-Michel

INEZA Felin-Michel

2 setembro 2026

Claude Fable 5.1 vs Fable 5: O Que Mudou e Vale a Pena Atualizar?

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

Claude Fable 5.1 substituiu o Fable 5 em 1º de setembro de 2026, mantendo os mesmos US$10 e US$50 por milhão de tokens, com leituras de cache reduzidas de US$1 para US$0,25 por milhão e melhores resultados em todos os benchmarks publicados pela Anthropic. O Fable 5 ainda é oferecido, e a página do modelo Fable 5 da Anthropic o mantém até pelo menos 9 de junho de 2027. Portanto, a questão não é se o Fable 5.1 é melhor no papel. A questão é se a atualização compensa o custo de migração para sua carga de trabalho e se alguma das três mudanças impactantes o afeta.

Esta comparação aborda o que é idêntico, o que melhorou, o que ficou mais caro ou difícil, e uma regra de decisão por carga de trabalho. As fontes são a publicação de lançamento da Anthropic e O que há de novo no Claude Fable 5.1. Para a ficha técnica completa, veja o que é o Claude Fable 5.1.

Lado a lado

Claude Fable 5.1 Claude Fable 5
ID do Modelo claude-fable-5-1 claude-fable-5
Lançado em 1º de setembro de 2026 9 de junho de 2026 (suspenso em 12 de junho, de volta em 1º de julho)
Desativação Não antes de 1º de setembro de 2027 Não antes de 9 de junho de 2027
Contexto / saída máxima 1M / 128K 1M / 128K
Corte de conhecimento Junho de 2026 Janeiro de 2026
Preço de entrada / saída $10 / $50 $10 / $50
Leitura de cache $0,25 por milhão $1,00 por milhão
Gravações de cache $12,50 (5m), $20 (1h) O mesmo
Processamento em lote $5 / $25 O mesmo
Tokenizador O mesmo (geração Opus 4.7) O mesmo
Raciocínio Adaptativo, sempre ativo Adaptativo, sempre ativo
tool_choice forçado 400 Aceito
Blocos de raciocínio legíveis por modelos mais antigos Não Sim
Verificação de edição de histórico Sim (imposto para contas criadas em ou após 31/08/2026) Não
Nível de Prioridade Não compatível Compatível
Esforço por mensagem Sim (beta) Não
Mensagens de sistema por turno Sim (beta) Não
thinking.display: "updates" Sim (beta) Sim (beta)
Proveniência do conteúdo Marca d'água de texto + C2PA na mídia Marca d'água de texto
Retenção de dados 30 dias obrigatório, Modelo Coberto O mesmo
Categorias de recusa Mesmas cinco Mesmas cinco

O que é idêntico

Mais do que você poderia esperar. A superfície da API, a janela de contexto de 1M, o limite de saída de 128K, os preços por token, o tokenizador, o mínimo de cache de 512 tokens, o raciocínio adaptativo sempre ativo, o padrão "omitted" para thinking.display, a proibição de pré-preenchimento, a proibição de parâmetros de amostragem, as mensagens de sistema no meio da conversa e o conjunto completo de categorias de recusa e mecânicas de fallback são todos mantidos inalterados. A Anthropic afirma que os prompts existentes do Fable 5 devem ter bom desempenho no Fable 5.1 sem alterações.

Isso significa que a maior parte do que escrevemos sobre o Fable 5 ainda se aplica: o guia de limites de taxa (os dois modelos até compartilham um pool de limites de taxa), o explicador de salvaguardas e o guia de disponibilidade na nuvem.

O que melhorou

Os benchmarks, segundo os números da Anthropic. Todas as linhas publicadas foram favoráveis ao Fable 5.1. As diferenças não são uniformes, no entanto.

Benchmark Fable 5.1 Fable 5 Delta
Terminal-Bench-Science 0.1 52.6% 24.7% +27.9
AutomationBench 31.4% 17.1% +14.3
Terminal-Bench 4.0 55.8% 42.0% +13.8
GDPval-AA v2 1853 1723 +130 Elo
OSWorld 2.0 (strict) 41.7% 36.1% +5.6
OSWorld 2.0 (partial) 77.9% 72.9% +5.0
Humanity’s Last Exam (no tools) 60.9% 57.8% +3.1
CursorBench 3.2.0 73.4% 70.5% +2.9
Humanity’s Last Exam (with tools) 65.0% 63.8% +1.2

O padrão: os maiores saltos estão em benchmarks de agentes de longo prazo (pesquisa científica em um terminal, automação de fluxo de trabalho de negócios, codificação por agente). Os menores estão em tarefas de conhecimento e codificação estilo IDE. Se sua carga de trabalho se parece com o topo da tabela, a atualização é grande. Se se parece com a parte inferior, são alguns pontos. Todos esses são resultados executados pelo fornecedor, sem reprodução independente ainda; o detalhamento dos benchmarks vai linha por linha.

Leituras de cache a um quarto do preço. De acordo com a página de preços, esta é a mudança que a maioria dos usuários do Fable 5 notará primeiro. Uma longa sessão de agente que relê um prefixo de 150.000 tokens a cada turno pagava US$0,15 por turno em leituras de cache no Fable 5 e paga US$0,0375 no Fable 5.1. A estimativa da Anthropic é de 25% mais barato em cargas de trabalho típicas e até 45% em cargas de trabalho de agentes. O detalhamento dos preços reproduz essa matemática com três exemplos práticos.

Menos falsos positivos das salvaguardas. Os classificadores do Fable 5 foram a reclamação mais comum depois que ele voltou em julho. A Anthropic relata que os classificadores de biologia disparam 85% menos frequentemente em solicitações benignas de biologia elementar e médicas do que os do Fable 5 no lançamento, e as salvaguardas cibernéticas causam cerca de 60% menos intervenções por sessão do Claude Code. O Fable 5.1 também pode identificar vulnerabilidades em código-fonte, o que o Fable 5 recusava. O desenvolvimento de exploits ainda é recusado.

Margem de esforço. A Anthropic afirma que medium no Fable 5.1 corresponde aproximadamente ao Fable 5 com um custo menor, e os ganhos sobre o Fable 5 são maiores em xhigh e max. Praticamente, uma carga de trabalho do Fable 5 executando em high pode frequentemente ser movida para o Fable 5.1 em medium para a mesma qualidade e menos tokens de saída, ou permanecer em high para um ganho de qualidade.

Corte de conhecimento. Junho de 2026 versus janeiro de 2026. Cinco meses extras de lançamentos de frameworks, mudanças de API e lançamentos de modelos que o modelo conhece sem precisar ser informado.

Três recursos de harness. Mudanças de esforço por mensagem sem reset de cache, mensagens de sistema com escopo por turno para lembretes a cada turno, e atualizações de progresso legíveis entre chamadas de ferramentas. O Fable 5 tem a última; as duas primeiras são novas.

O que ficou mais difícil

O uso forçado de ferramentas foi removido. tool_choice any e tool retornam um erro 400 no Fable 5.1. Se você os usava para garantir JSON, mude para strict: true em auto ou para saídas estruturadas. Se você os usava porque o aplicativo exige uma chamada em um determinado turno, adicione uma mensagem de sistema no meio da conversa que indique isso. Não é difícil, mas é uma mudança de código em cada local de chamada de ferramenta forçada.

Blocos de raciocínio são unidirecionais. O Fable 5.1 lê os blocos de raciocínio do Fable 5, então uma conversa que avança mantém seu raciocínio. O Fable 5 não consegue ler os do Fable 5.1. Durante uma transição gradual em que um roteador possa enviar uma conversa de volta, a API descarta os blocos, sem cobrança, e o Fable 5 replaneja aquele turno.

A verificação de edição de histórico. Os blocos de raciocínio do Fable 5.1 são válidos apenas na conversa exata que os produziu. Edite um turno anterior, reconstrua o prompt do sistema ou troque o array de ferramentas, e a próxima requisição que reproduzir o bloco falhará em contas criadas em ou após 31 de agosto de 2026. O Fable 5 nunca verificou isso. Se seu harness injeta e deleta lembretes por turno, atualiza a data no prompt do sistema, ou compacta no cliente mantendo os turnos recentes literalmente, reserve um tempo real aqui. O guia de raciocínio preservado cobre a auditoria e as correções, e o guia de migração tem a lista completa.

Nível de Prioridade. O Fable 5 suporta; o Fable 5.1 não. Para garantias de capacidade empresarial, essa é uma razão para permanecer no Fable 5 até que a Anthropic o adicione.

Comportamento do loop de agente. Três mudanças ajustáveis por prompt: o Fable 5.1 pode emitir uma chamada de ferramenta por turno onde o Fable 5 agrupava várias, ele escreve menos atualizações de progresso, e com esforço low ele responde da memória com mais frequência em vez de pesquisar. Cada um tem uma correção de uma linha no guia de prompting, mas cada um também é uma mudança que você precisa notar.

Regra de decisão por carga de trabalho

Atualize agora se seu trabalho envolve codificação por agente de longa duração, pesquisa multifásica ou geração de documentos e planilhas. É aí que os ganhos de benchmark se concentram, onde o preço da leitura de cache mais impacta, e onde a queda de falsos positivos das salvaguardas mais importa. A Cognition disse que estava movendo seu tráfego Devin para o Fable 5.1 no dia do lançamento, o que é o sinal público mais claro dessa lógica.

Atualize após a auditoria do harness se seu código constrói o array messages por conta própria e faz algo além de anexar turnos. Execute a verificação de edição de histórico de três etapas primeiro, corrija cada prefix_binding_mismatch, depois troque. A verificação é barata; descobrir isso em produção não é.

Atualize para medium se o Fable 5 no nível high estava realizando o trabalho rotineiro bem e você deseja a mesma qualidade por menos. Refaça a varredura de esforço em suas avaliações em vez de assumir que os níveis se equivalem.

Mantenha-se no Fable 5 se o Nível de Prioridade for crítico, ou se sua carga de trabalho for intensiva em saída com pouco prefixo em cache (onde a mudança de preço mal se registra e o custo de migração é pura sobrecarga). O Fable 5 está comprometido até pelo menos 9 de junho de 2027, então não há pressa.

Considere o Opus 5 em vez disso se a resposta honesta for que o Fable 5 já era mais modelo do que você precisava. A própria orientação da Anthropic é começar com o Opus 5 e só mudar para cima quando ele não for suficiente. A comparação Fable 5.1 vs Opus 5 aborda isso pela metade do preço.

Testando ambos os modelos um contra o outro no Apidog

A maneira mais clara de resolver isso para sua própria carga de trabalho é uma coleção lado a lado. No Apidog, salve seus dez prompts de produção mais difíceis como requisições com model como variável de ambiente, execute a coleção uma vez contra claude-fable-5 e outra vez contra claude-fable-5-1 com o mesmo esforço, e compare três campos por requisição: o texto, usage.output_tokens e usage.cache_read_input_tokens na segunda execução. Adicione mais uma requisição que use um tool_choice forçado, para que você veja o erro 400 antes que seus usuários o vejam. Baixe o Apidog para configurá-lo; o guia da API tem os corpos das requisições.

FAQ

O Claude Fable 5.1 é um novo modelo ou uma atualização do Fable 5? Um novo modelo com seu próprio ID, claude-fable-5-1, e sua própria data de desativação. Ele usa o mesmo tokenizador e preços por token do Fable 5 e foi treinado com dados até junho de 2026.

O Fable 5.1 custa mais que o Fable 5? Não. Mesmos US$10 e US$50 por milhão de tokens, mesmas gravações de cache, mesmas taxas de processamento em lote. As leituras de cache são mais baratas: US$0,25 por milhão versus US$1.

Meu código do Fable 5 funcionará no Fable 5.1? A maior parte sim. O tool_choice forçado retorna um erro 400, e o código que edita o histórico da conversa entre requisições invalidará blocos de raciocínio em contas criadas em ou após 31 de agosto de 2026. Todo o resto é mantido.

O Fable 5 será desativado? Ainda não. O compromisso da Anthropic é que o Fable 5 não será desativado antes de 9 de junho de 2027, em plataformas operadas pela Anthropic. Bedrock e Google Cloud definem suas próprias datas.

Qual é melhor em codificação, Fable 5.1 ou Fable 5? Segundo os números da Anthropic, o Fable 5.1: 55,8% vs 42,0% no Terminal-Bench 4.0 e 73,4% vs 70,5% no CursorBench 3.2.0. A diferença no terminal-agente é grande; a diferença no estilo IDE é pequena. Ambos são resultados executados pelo fornecedor.

O Fable 5.1 recusa menos que o Fable 5? A Anthropic relata 85% menos falsos positivos em biologia e cerca de 60% menos intervenções cibernéticas por sessão do Claude Code. As categorias são as mesmas, então mantenha seu tratamento de recusas e fallbacks em vigor.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs