O preço do Claude Fable 5 começa em $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída na API da Anthropic. Essa é a história completa para a maioria das pessoas que só querem um número, mas o quadro completo tem algumas partes móveis que valem a pena conhecer antes de integrar o modelo à produção. O Fable 5 foi lançado em 9 de junho de 2026, e a Anthropic o posiciona como custando “menos da metade do preço do Claude Mythos Preview”. Este guia detalha cada alavanca de custo: as taxas da API, o que você paga nos planos Pro e Max, três exemplos práticos com aritmética real e como o Fable 5 se alinha contra modelos mais baratos como o Claude Opus 4.8. Se você só precisa de uma verificação rápida de custo, a próxima seção a tem.
TL;DR
O Claude Fable 5 custa $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída na API. De 9 de junho a 22 de junho de 2026, ele está incluído gratuitamente nos planos Pro, Max, Team e Enterprise baseados em assentos. A partir de 23 de junho de 2026, o uso nesses planos consumirá créditos de uso medido nas mesmas taxas de token de $10/$50.
Preço do Claude Fable 5 em resumo
Aqui estão os números principais em uma tabela. A coluna "por 1K tokens" é o mesmo preço expresso em uma unidade menor, o que é útil ao estimar o custo de uma única solicitação.
| Tipo de Token | Preço por 1M tokens | Preço por 1K tokens | Notas |
|---|---|---|---|
| Entrada | $10.00 | $0.01 | Tudo o que você envia: prompt, mensagem do sistema, contexto, definições de ferramentas |
| Saída | $50.00 | $0.05 | Tudo o que o modelo gera, incluindo raciocínio e chamadas de ferramenta |
O ID do modelo da API é claude-fable-5. Os tokens de saída custam 5x mais que os tokens de entrada, o que é normal para modelos Anthropic de fronteira e molda a maior parte dos conselhos de otimização posteriores neste post. Você pode confirmar as taxas atuais a qualquer momento na página de preços da Anthropic e na documentação de modelos e preços.
O que você paga na API
A Anthropic cobra duas coisas separadamente, e você paga por ambas.
Tokens de entrada são tudo o que você envia ao modelo em uma solicitação. Isso inclui o texto do seu prompt, a mensagem do sistema, quaisquer turnos de conversa anteriores que você reproduza para contexto, documentos recuperados e o JSON para quaisquer ferramentas que você defina. Estes contam a $10 por milhão, ou um centavo por mil.

Tokens de saída são tudo o que o modelo gera em resposta. Essa é a resposta visível, mais qualquer raciocínio interno que o modelo produza e quaisquer argumentos de chamadas de ferramenta que ele escreva. Estes contam a $50 por milhão, ou cinco centavos por mil.
Assim, uma única solicitação que envia 2.000 tokens de entrada e recebe 600 tokens de volta custa 2.000 tokens de entrada mais 600 tokens de saída, cobrados em suas taxas separadas. Não há uma taxa fixa por solicitação adicional. Sua conta é puramente a soma dos tokens de entrada e saída em cada chamada que você faz.
A Anthropic descreve o Fable 5 como “menos da metade do preço do Claude Mythos Preview”, que é o posicionamento do modelo em relação ao nível de fronteira de pré-visualização anterior. O modelo irmão restrito, Claude Mythos 5, possui a mesma taxa de $10 de entrada e $50 de saída, portanto, alternar entre os dois não altera seu custo por token. Se você deseja o contexto conceitual sobre o próprio modelo antes de orçá-lo, o que é o Claude Fable 5 aborda o lado das capacidades.
Inclusão no plano vs. créditos de uso
O preço na API é uma coisa. O que você paga em um plano de assinatura Claude segue uma programação diferente, e as datas importam.
De 9 de junho a 22 de junho de 2026, o Claude Fable 5 está incluído sem custo adicional nos planos Pro, Max, Team e Enterprise baseados em assentos. Durante esta janela, você pode usar o modelo nesses planos sem que ele conte contra qualquer saldo medido. Esta é uma promoção de período de lançamento, não o estado permanente.
Em 23 de junho de 2026, o Fable 5 é removido do conjunto incluído nesses planos. Após essa data, o uso do Fable 5 no Pro, Max, Team ou Enterprise baseado em assentos consumirá créditos de uso, o que significa que será medido nas mesmas taxas de $10 de entrada e $50 de saída por milhão de tokens que você pagaria na API bruta. A Anthropic disse que planeja restaurar algum acesso padrão ao plano quando a capacidade permitir, então o estado pós-23 de junho pode suavizar mais tarde, mas o comportamento medido por crédito é o que você deve orçar no momento.
Os planos Enterprise baseados em consumo são diferentes. O Fable 5 está totalmente disponível lá desde o lançamento, sem que haja uma janela de inclusão para se preocupar, já que esses planos cobram pelo uso desde o início. Se sua pergunta de acesso for mais ampla do que o faturamento, como acessar o Claude Fable 5 mapeia cada ponto de entrada.
A conclusão prática: se você está prototipando em um assento Pro ou Max esta semana, você tem liberdade total até 22 de junho. Planeje seus experimentos mais pesados de acordo, e se você espera tráfego de produção sustentado, modele seus custos com base nas taxas de API de $10/$50 em vez da janela gratuita, porque é nisso que você se estabelece.
Exemplos práticos: o custo de uma carga de trabalho real
Números por milhão de tokens são abstratos. Aqui estão três cargas de trabalho concretas com a aritmética detalhada, para que você possa mapear seu próprio uso nelas.
A fórmula é a mesma sempre: (tokens de entrada / 1.000.000) * $10 mais (tokens de saída / 1.000.000) * $50.
Exemplo 1: Um turno de chatbot de suporte
Um turno típico de suporte ao cliente carrega algumas instruções do sistema e um breve histórico de conversa, então retorna uma resposta focada. Digamos 1.500 tokens de entrada e 500 tokens de saída.
- Entrada: 1.500 / 1.000.000 * $10 = $0.015
- Saída: 500 / 1.000.000 * $50 = $0.025
- Total: $0.04 por turno
Quatro centavos por turno. Se esse chatbot lida com 1.000 turnos por dia, você está olhando para aproximadamente $40/dia, ou cerca de $1.200/mês, antes de qualquer uma das alavancas de custo na próxima seção. Isso é uma verificação útil: cargas de trabalho estilo chat no Fable 5 permanecem baratas por chamada, mas somam-se em volume.
Exemplo 2: Uma solicitação de geração de código
A geração de código geralmente envia mais contexto: o arquivo que você está editando, trechos relacionados e instruções. Digamos 8.000 tokens de entrada e 3.000 tokens de saída para uma função gerada substancial com explicação.
- Entrada: 8.000 / 1.000.000 * $10 = $0.08
- Saída: 3.000 / 1.000.000 * $50 = $0.15
- Total: $0.23 por solicitação
Observe que, embora você tenha enviado quase 3x mais entrada do que saída, a saída ainda domina a conta com $0,15 dos $0,23. Essa proporção de preço de 5:1 de saída para entrada é o motivo pelo qual cortar gerações verbosas economiza dinheiro real.
Exemplo 3: Uma execução de agente de longo prazo
Execuções de agentes que leem grandes bases de código ou documentos e dão muitos passos aumentam muito a entrada. Digamos 300.000 tokens de entrada (muito contexto recuperado reproduzido em várias etapas) e 50.000 tokens de saída.
- Entrada: 300.000 / 1.000.000 * $10 = $3.00
- Saída: 50.000 / 1.000.000 * $50 = $2.50
- Total: $5.50 por execução
Uma única execução profunda de agente custa cerca de cinco dólares e meio. Execute isso 200 vezes por dia em uma equipe e você terá $1.100/dia. Este é exatamente o tipo de carga de trabalho onde o cache de prompts compensa, porque os agentes reproduzem o mesmo grande contexto repetidamente. Quantificaremos isso a seguir.
Como reduzir sua conta do Claude Fable 5
Depois de decidir que o Fable 5 é o modelo certo, estes são os recursos padrão da API da Anthropic que reduzem o custo. Nenhum deles requer acesso especial.
- Cache de prompts. Leituras do cache custam cerca de 0,1x o preço de entrada, então a entrada em cache custa cerca de $1 por milhão em vez de $10. Gravações no cache custam cerca de 1,25x a entrada (cerca de $12.50 por milhão para um TTL de 5 minutos), então o cache compensa quando você reutiliza o mesmo contexto em muitas solicitações. Pegue a execução do agente do Exemplo 3: se 250.000 dos 300.000 tokens de entrada são contexto estável servido do cache, essa entrada cai de $3.00 para cerca de $0.25 (250K leituras em cache a $1/M = $0.25, mais 50K entrada nova a $10/M = $0.50). A execução inteira cai de $5.50 para aproximadamente $3.25. Para agentes e chatbots que reproduzem um grande prompt de sistema, o cache é a maior mudança de custo que você pode fazer.
- API de Lotes. Para trabalhos que não precisam de uma resposta imediata, como processamento noturno de documentos ou classificação em massa, a API de Lotes funciona com cerca de 50% de desconto. Isso transforma as taxas de $10/$50 em aproximadamente $5/$25, o que é um preço de nível Opus para saída de nível Fable. Se o seu trabalho tolera um atraso, isso é quase dinheiro de graça.
- Dimensionar o modelo corretamente. Nem toda solicitação precisa do Fable 5. Encaminhe o raciocínio difícil e inovador para o Fable e envie o tráfego de rotina para o Opus 4.8, Sonnet 4.6 ou Haiku 4.5. Um roteador em camadas que envia 80% das chamadas para um modelo mais barato pode cortar uma conta em mais da metade por si só.
- Reduzir max_tokens. A saída é o lado caro a $50 por milhão. Defina
max_tokenspara o que a tarefa realmente precisa, em vez de deixá-lo aberto, e peça respostas concisas no prompt. Reduzir uma geração de 3.000 tokens para 1.500 tokens reduz pela metade o custo de saída dessa chamada. - Transmitir respostas. O streaming não altera o preço por token, mas permite que você pare a geração mais cedo, uma vez que tenha o que precisa, e melhora a latência percebida, então você fica menos tentado a solicitar em excesso. Combinado com um
max_tokensapertado, ele mantém os gastos com saída honestos.
Rastreie os gastos do Claude Fable 5 com Apidog
A maneira mais limpa de manter os custos de tokens visíveis enquanto você desenvolve é observá-los em cada solicitação, não no final do mês, quando a fatura chega. O Apidog é um cliente de API que você pode usar para enviar solicitações à API da Anthropic e inspecionar exatamente o que retorna.

Ao chamar claude-fable-5 através do Apidog, o corpo da resposta inclui um objeto usage com input_tokens e output_tokens para aquela solicitação. A leitura desses dois números informa o custo preciso da chamada: multiplique os tokens de entrada por $0.00001 e os tokens de saída por $0.00005, adicione-os, e você terá a conta para aquela solicitação até a fração de um centavo. Fazer isso enquanto você itera em prompts mostra imediatamente quando uma mudança infla sua contagem de tokens, muito antes de aparecer na produção.
Um fluxo de trabalho prático: configure a solicitação de preenchimento de chat da Anthropic no Apidog, salve alguns prompts representativos como exemplos e compare os números de usage entre as variações de prompt. Você verá rapidamente quais edições de mensagem do sistema adicionam centenas de tokens de entrada e quais mudanças de formato de resposta incham a saída. Esse ciclo de feedback é difícil de obter apenas do painel. Baixe o Apidog para configurar isso e combine-o com o guia da API do Claude Fable 5 para a estrutura da solicitação. Se você está monitorando o orçamento de perto, como usar o Claude Fable 5 gratuitamente cobre os caminhos sem custo durante a janela de inclusão.
O Apidog também mantém um histórico de solicitações, para que você possa consultar chamadas anteriores e suas contagens de tokens ao estimar o custo de um novo recurso. Tratar o Apidog como sua camada de inspeção de custos durante o desenvolvimento significa que não há surpresas de tokens quando o tráfego aumenta.
O preço do Claude Fable 5 se resume a um par simples de números, $10 de entrada e $50 de saída por milhão de tokens, com uma janela de plano gratuito até 22 de junho e créditos medidos após 23 de junho. O resto é matemática de carga de trabalho e algumas alavancas de custo: armazene em cache seu contexto estável, lote o que não for urgente e reduza para o Opus 4.8 ou Sonnet 4.6 quando a tarefa não exigir o nível de fronteira. Seu próximo passo é configurar uma única solicitação claude-fable-5 e ler o objeto usage para que suas estimativas se baseiem em contagens de tokens reais. Baixe o Apidog para enviar essa primeira solicitação e observar o custo em tempo real.
