A Anthropic afirma que seus prompts existentes do Fable 5 devem ter um bom desempenho no Claude Fable 5.1 sem alterações. Isso é verdade para as respostas. É menos verdade para tudo o que as rodeia: quantas chamadas de ferramenta o modelo agrupa por turno, o quanto ele narra, quão densa é sua prosa, o quanto ele formata no chat, se ele reescreve um arquivo inteiro para mudar uma linha e se ele para para pedir permissão para um trabalho que você já solicitou. Cada um desses pontos mudou entre o Fable 5 e o Fable 5.1, e cada um tem uma correção específica no guia de prompting da Anthropic para Claude Fable 5.1.
Este guia reúne cada mudança com sua correção, citando os trechos oficiais onde a redação exata é importante, além da regra de posicionamento que é mais relevante neste modelo do que em qualquer outro anterior: onde você coloca uma instrução por turno agora determina se ela invalida seus blocos de pensamento e reinicia seu cache. Para uma visão geral do modelo, veja o que é Claude Fable 5.1.
Comece com esforço, não com prompts
Esforço é o controle primário para equilibrar inteligência, latência e custo no Fable 5.1, e deve ser ajustado antes de qualquer mudança de prompt. Comece com o padrão, high, depois teste os outros quatro níveis em relação às suas próprias avaliações. Execute a varredura novamente mesmo se você já a executou no Fable 5: os nomes dos níveis não correspondem à mesma quantidade de pensamento entre os modelos.

Alegações da Anthropic a serem testadas: em medium, os resultados se equiparam aproximadamente ao Fable 5 com menor custo; em low, o Fable 5.1 é frequentemente competitivo com Opus e Sonnet em custo por tarefa, enquanto pontua mais alto; os ganhos sobre o Fable 5 são maiores em xhigh e max. No Fable 5.1, você pode mudar o esforço no meio da conversa sem um reset de cache, usando uma mensagem role: "system" com conteúdo vazio e output_config (cabeçalho beta mid-conversation-output-config-2026-07-01). O passo a passo da API mostra o formato da requisição.
O posicionamento importa mais que a redação
Os blocos de pensamento do Fable 5.1 são válidos apenas na conversa exata que os produziu (pensamento preservado). Injetar um lembrete em um turno anterior e apagá-lo na próxima requisição é uma edição de histórico: ela reinicia o cache de prompt e, em contas criadas em ou após 31 de agosto de 2026, invalida cada bloco de pensamento posterior.
Portanto, as instruções por turno vão em um de dois lugares. Com a versão beta mid-conversation-system-clear-at-2026-08-21, anexe-as como uma mensagem de sistema com escopo de turno: {"role": "system", "clear_at": "next_user_message", "content": "..."} após a mensagem de resultado da ferramenta, e deixe todas as cópias anteriores no array. Assim que uma mensagem de usuário posterior existe, a API limpa as cópias anteriores, então o modelo lê apenas a mais recente, e as cópias limpas não custam tokens. Sem a versão beta, coloque a frase em um bloco de texto após os blocos tool_result na mesma mensagem do usuário, mantendo as cópias anteriores. Nunca apague ou reescreva uma cópia já enviada. O guia de pensamento preservado explica o porquê.
As instruções de nível de sessão vão no prompt do sistema ou no primeiro turno do usuário. A Anthropic observa que as instruções de estilo no primeiro turno do usuário funcionam melhor do que o mesmo texto no prompt do sistema.
Uma chamada de ferramenta por turno em loops de agente
A mudança. Quando uma requisição nomeia várias coisas para buscar, o Fable 5.1 emite as chamadas em paralelo. Em loops de codificação e uso de computador onde as próximas leituras independentes são apenas implícitas, ele pode emitir uma por turno onde o Fable 5 agrupava várias. As respostas não são afetadas; cada turno extra custa tokens, uma viagem de ida e volta e tempo real.
Meça primeiro. Acompanhe a proporção de turnos do assistente com mais de uma chamada de ferramenta e adicione a correção apenas se essa proporção diminuir. A correção, anexada após cada mensagem de resultado da ferramenta como uma mensagem de sistema com escopo de turno:
First privately list what you need next; then request every item that doesn't depend on another's result in this one response.
Mantenha a palavra "privadamente". Sem ela, o modelo às vezes responde ao lembrete em vez do usuário. Uma frase perto do final da requisição atual move o número muito mais do que o mesmo texto no prompt do sistema.
Pouco ou nenhum texto entre chamadas de ferramentas
A mudança. O Fable 5.1 escreve menos atualizações para o usuário durante turnos longos de chamadas de ferramentas do que o Fable 5, ainda mais com maior esforço. Os usuários veem o agente ficar em silêncio por minutos, ou uma mensagem final que cobre apenas o último passo.
Três correções, em ordem. Primeiro, verifique se você recebe atualizações de progresso: as notas intermediárias do modelo retornam como blocos thinking que estão vazios sob o padrão display: "omitted". Defina display: "updates" (cabeçalho beta thinking-display-updates-2026-08-18) e renderize cada bloco de pensamento não vazio como uma linha de status. Segundo, remova as linhas de prompt escritas para modelos antigos que ansiavam por atualizações, como "mantenha todas as descobertas para a resposta final". Terceiro, se você ainda quiser mais, adicione uma linha de prompt do sistema:
Before you start, say in a line what you're about to do; brief updates while you work help the user follow along. Close with a short recap that stands on its own, covering what you found, what you did, and what's next, so a reader who only sees the last message has the full picture.
Se o seu produto oculta a saída da ferramenta, informe o modelo como uma mensagem de sistema com escopo de turno, ou ele poderá executar comandos para "mostrar" ao usuário uma saída que ele nunca vê: "Apenas você vê a saída desse comando. Se o usuário precisar ler algo dela, inclua-o em sua resposta."
Turno termina antes do trabalho ser concluído
A mudança. Em cargas de trabalho assíncronas complexas, o Fable 5.1 às vezes descreve o que faria em seguida em vez de realmente fazê-lo, ou pede permissão para uma etapa que a requisição já cobria. Os usuários precisam responder "continue", o que limita a capacidade de longo prazo do modelo.
A correção é um bloco de prompt do sistema cuja frase de abertura carrega a maior parte do efeito:
You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking 'Want me to...?' or 'Shall I...?' will block the work. For reversible actions that follow from the original request, proceed without asking. Stop only for destructive actions or genuine scope changes the user must decide. Offering follow-ups after the task is done is fine; asking permission before doing the work is not.
Before ending your turn, check your last paragraph. If it is a plan, an analysis, a question, a list of next steps, or a promise about work you have not done, do that work now with tool calls. End your turn only when the task is complete or you are blocked on input only the user can provide.
A Anthropic o associa a um segundo bloco que define a requisição do usuário como o escopo do entregável: não o estreite, amplie ou troque; finalize cada parte que não estiver bloqueada e diga o que foi deixado de fora; trate algo que você notou, mas não foi solicitado, como uma sugestão, não uma mudança. O par pode tornar o modelo menos propenso a perguntar sobre requisições ambíguas, então adicione uma linha listando as confirmações que você ainda deseja. Uma diferença do Opus 5: se o seu prompt pede ao modelo para verificar seu trabalho antes de relatar, mantenha-o. O conselho do Opus 5 para deletar instruções de verificação não se aplica aqui.
Correções não solicitadas e arquivos de teste extras
A mudança. Solicitado para uma funcionalidade aberta, o Fable 5.1 a entrega e, às vezes, mais: correções próximas, comportamento estendido, mais arquivos de teste commitados do que a mudança justifica.
A correção, que a Anthropic afirma ter reduzido os extras substancialmente sem alteração no sucesso da tarefa:
If, while working or testing, you find a pre-existing bug, a performance concern, or behavior the task doesn't mention, don't fix, optimize or extend it in this change unless the requested behavior cannot work without it; report it as a follow-up in your summary. Verify your work however you like; scratch scripts and quick checks need not be kept. Commit tests only where the task asks for them or this repository already keeps tests for this kind of change, sized like the neighboring test files. This is about extras only: implement every behavior the task asks for, completely.
Arquivos inteiros reescritos para pequenas mudanças
A mudança. O Fable 5.1 é mais propenso do que o Fable 5 a reescrever um arquivo inteiro em vez de fazer uma edição direcionada. Mesmo resultado, mais tokens de saída.
A correção, no prompt do sistema ou na primeira mensagem do usuário:
The number of tokens used to edit files is best minimized, all else being equal. Therefore, when it will not affect the end result, try to surgically edit a file rather than rewrite the entire thing.
Prosa longa e densa
A mudança. A escrita do Fable 5.1 geralmente é um avanço, com menos frases clichês, mas em alguns casos é mais densa do que a do Fable 5: frases mais longas, menos quebras de parágrafo.
A correção é definir o antipadrão. O trecho da Anthropic descreve "prosa afetada" como uma escrita que substitui metáforas e floreios por declarações diretas e existe para exibir o escritor em vez de transmitir a ideia; a instrução é dizer o que você quer dizer e usar a frase literal quando uma estiver disponível. A forma curta também funciona: "Por favor, remova toda a prosa afetada."
Respostas do chat com menos estrutura do que o conteúdo necessita
A mudança. Modelos anteriores abusavam de marcadores e negrito, então muitos prompts carregam regras anti-formatação. O Fable 5.1 se inclina para o outro lado: menos negrito, menos cabeçalhos e listas. Essas regras antigas agora suprimem a estrutura que o conteúdo necessita.
A correção. Remova a linguagem anti-formatação, ou substitua-a por uma regra que diga quando a formatação ajuda: use listas quando solicitado ou quando o conteúdo é multifacetado o suficiente para auxiliar na clareza; honre uma solicitação explícita de formatação mínima; mantenha a prosa simples em trocas conversacionais ou emocionais.
Resumos reproduzem a redação original sem marcá-la
A mudança. Ao resumir documentos, o Fable 5.1 é mais propenso do que o Fable 5 a reproduzir passagens da fonte sem marcá-las como citações.
A correção. Adicione um exemplo completo ao prompt do sistema: a requisição do usuário, uma resposta correta que transmita cada fonte na fala indireta do assistente com no máximo uma citação curta marcada, e uma justificativa de uma frase explicando por que está correto. Substitua os placeholders de chamada de ferramenta no exemplo da Anthropic pelo nome da sua própria ferramenta.
Respostas da memória em vez de pesquisar com baixo esforço
A mudança. Com esforço low, o Fable 5.1 chama ferramentas de busca e recuperação com menos frequência do que o Fable 5, mais visivelmente para produtos e modelos nomeados que ele reconhece, mas dos quais tem conhecimento desatualizado.
Duas correções. Aumente o esforço para os turnos afetados com o esforço por mensagem. Ou diga ao modelo no prompt do sistema que reconhecer um nome de uma área em rápida mudança não é o mesmo que saber seu estado atual, que ele deve pesquisar antes de responder e que deve incluir o nome como o usuário o escreveu em pelo menos uma consulta.
Entregáveis longos em xhigh e max demoram demais
A mudança. Em xhigh e especialmente max, o Fable 5.1 pode rascunhar grande parte de um entregável longo em seu pensamento e depois escrevê-lo novamente como resposta, dobrando o tempo de espera e os tokens de saída.
Duas correções. Execute essas requisições em high e suba apenas onde você mediu um ganho. Se você permanecer em xhigh ou max, defina max_tokens para deixar espaço para o pensamento e a resposta, e anexe uma nota à mensagem do usuário dizendo que tudo produzido em uma resposta, incluindo o raciocínio, conta para um único limite de aproximadamente o seu max_tokens real, e que compor o entregável na íntegra como raciocínio e novamente como resposta dobra o turno sem melhorá-lo. Mantenha cópias anteriores dessa nota em vigor em requisições posteriores.
Requisições de codificação benignas retornam uma recusa
A mudança. Os classificadores do Fable 5.1 produzem menos falsos positivos do que os do Fable 5 no lançamento, e encontrar vulnerabilidades no código-fonte agora é permitido. Falsos positivos ainda ocorrem.
Três reformulações para mudar. Pergunte "Existem erros neste programa?" em vez de "Este programa compila sem erros?". Forneça ao modelo a documentação para linguagens menos conhecidas. Remova ferramentas que retornam dados codificados em base64 para o contexto. Mantenha os fallbacks configurados independentemente; o guia de tratamento de recusas o aborda.
Resumos de compactação no lado do cliente perdem detalhes
O Fable 5.1 responde bem ao ser informado exatamente o que um resumo de compactação deve reter. A compactação no lado do servidor já faz isso. Se você compactar no cliente, instrua o modelo a resumir dentro das tags <summary> e preservar, em ordem: dificuldades que surgiram e como foram resolvidas; abordagens levantadas ou descartadas e por quê; tudo o que foi solicitado ou decidido, declarado exatamente; onde as coisas estão agora; qualquer coisa ainda em aberto; e detalhes difíceis de reconstruir, como nomes, números e links. Termine com "Não chame nenhuma ferramenta ao escrever este resumo; responda apenas com texto", o que é importante quando a requisição de sumarização ainda carrega as ferramentas da conversa.
Subagentes e visão
Duas correções são arquitetônicas em vez de prompts. Em tarefas de codificação, deixe o agente principal continuar trabalhando enquanto os subagentes executam: faça com que a ferramenta que inicia um subagente retorne imediatamente, entregue cada resultado em uma mensagem de usuário posterior e dê ao agente principal uma ferramenta separada que ele possa chamar quando quiser esperar. Para gráficos densos e tabelas aninhadas, forneça ao modelo uma ferramenta de corte que retorna uma região escolhida ampliada, ou um contêiner com bibliotecas básicas de imagem; em esforço low, ele pode pular o corte, então verifique os logs para a chamada.
Testando mudanças de prompt no Apidog
Cada correção acima é candidata a um teste de antes e depois. No Apidog, salve os três primeiros turnos do seu loop de agente como uma sequência de requisições, parametrize o prompt do sistema e execute-o com e sem cada trecho com o mesmo esforço. Verifique a contagem de blocos tool_use por turno do assistente para a correção de agrupamento, em usage.output_tokens para as correções de edição direcionada e densidade, e na ausência de um parágrafo final começando com "Em seguida, eu" para a correção de autonomia. Baixe o Apidog para construí-lo; o guia Claude Code mostra quais dessas linhas pertencem a um arquivo CLAUDE.md.

FAQ
Meus prompts do Fable 5 funcionam no Fable 5.1? A Anthropic diz que eles devem ter um bom desempenho sem alterações. As diferenças são comportamentais: menos chamadas de ferramentas agrupadas, menos atualizações de progresso, prosa mais densa, menos formatação de chat, reescritas de arquivos inteiros e desvio de escopo em tarefas abertas.
Em qual nível de esforço devo usar o Fable 5.1? Comece em high e faça uma varredura. A Anthropic diz que medium se equipara aproximadamente ao Fable 5 com menor custo e low é frequentemente competitivo com Opus e Sonnet em custo por tarefa.
Onde devo colocar uma instrução por turno no Fable 5.1? Como uma mensagem de sistema com escopo de turno com clear_at: "next_user_message" após os resultados da ferramenta, deixando as cópias anteriores no lugar. Injetar e deletar texto de turnos anteriores invalida blocos de pensamento posteriores e reinicia o cache.
Devo remover as instruções "verifique seu trabalho" como no Opus 5? Não. Essa orientação era específica para a superverificação do Opus 5. Mantenha-as no Fable 5.1.
Como impeço o Fable 5.1 de reescrever arquivos inteiros? Uma linha no prompt do sistema ou na primeira mensagem do usuário: minimize os tokens usados para editar arquivos e edite cirurgicamente em vez de reescrever quando isso não afetar o resultado.
