Claude Fable 5.1 Prix : Répartition Complète des Coûts (2026)

Tarification de Claude Fable 5.1 : 10 $/50 $ par MTok, 0,25 $ par lecture de cache (75 % de moins que Fable 5), tarifs par lots, et les calculs de coûts détaillés étayant les affirmations d'économies de 25 % et 45 %.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Claude Fable 5.1 Prix : Répartition Complète des Coûts (2026)

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Claude Fable 5.1 coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie, exactement comme Fable 5. Le chiffre qui a changé est la lecture du cache de prompt : 0,25 $ par million de jetons, contre 1 $ sur Fable 5 et la moitié des 0,50 $ d'Opus 5. Anthropic estime que cela rend les charges de travail typiques environ 25 % moins chères que Fable 5 et les charges de travail fortement agentiques jusqu'à environ 45 % moins chères.

Ce guide présente tous les tarifs de la page de tarification officielle, reproduit les affirmations de 25 % et 45 % afin que vous puissiez y insérer votre propre taux de réussite de cache, propose trois exemples réels de coût par tâche, et liste les leviers qui influencent la facture. Si vous souhaitez d'abord un aperçu du modèle, lisez ce qu'est Claude Fable 5.1.

Table des prix de Claude Fable 5.1

Tarif Claude Fable 5.1
Entrée de base 10 $ par million de jetons
Sortie 50 $ par million de jetons
Écriture en cache (5 min) 12,50 $ par million (1,25x entrée)
Écriture en cache (1 heure) 20 $ par million (2x entrée)
Lecture en cache (succès ou rafraîchissement) 0,25 $ par million (0,025x entrée)
Entrée API en lot 5 $ par million
Sortie API en lot 25 $ par million
Prime pour contexte long Aucune ; la fenêtre complète de 1M est facturée aux tarifs standards
inference_geo: "us" 1,1x sur chaque catégorie de jetons
Mode rapide Non disponible (Opus 5 et Opus 4.8 uniquement)
Niveau de priorité Non pris en charge
Recherche web 10 $ pour 1 000 recherches, plus les jetons

Claude Mythos 5.1 a les mêmes tarifs. La réduction pour traitement par lots et les multiplicateurs de cache se cumulent, de sorte qu'une lecture de cache par lots coûte 0,125 $ par million.

Comparaison du prix de lecture du cache

Modèle Entrée de base Lecture en cache Lecture en cache en pourcentage de l'entrée
Claude Fable 5.1 10 $ 0,25 $ 2,5%
Claude Fable 5 10 $ 1,00 $ 10%
Claude Opus 5 5 $ 0,50 $ 10%
Claude Opus 4.8 5 $ 0,50 $ 10%
Claude Sonnet 5 2 $ 0,20 $ 10%
Claude Haiku 4.5 1 $ 0,10 $ 10%

Tous les autres modèles Claude facturent un succès de cache à 10 % de l'entrée de base. Fable 5.1 le facture à 2,5 %. L'effet pratique : un succès de cache de Fable 5.1 est moins cher qu'un succès de cache d'Opus 5, même si l'entrée non mise en cache de Fable 5.1 est deux fois plus chère. Pour une charge de travail où la plupart des jetons d'entrée sont un préfixe mis en cache, le taux d'entrée effectif sur Fable 5.1 peut descendre en dessous de celui d'Opus 5.

Une note sur Sonnet 5, étant donné que la comparaison Opus 5 vs Sonnet 5 avait signalé une augmentation de prix en septembre : Anthropic l'a annulée. Sonnet 5 reste à 2 $ et 10 $.

Reproduire les affirmations de 25 % et 45 %

Anthropic n'a pas publié le mix de charges de travail derrière ces estimations, considérez donc ceci comme une reconstitution qui montre le ratio de succès de cache qu'elles impliquent, et non comme leur modèle exact.

Soit une requête avec U jetons d'entrée non mis en cache, C jetons d'entrée mis en cache et O jetons de sortie. Le coût par million sur Fable 5 est de 10U + 1.0C + 50O ; sur Fable 5.1, il est de 10U + 0.25C + 50O. L'économie est de 0.75C, et le pourcentage d'économie est de 0.75C / (10U + C + 50O).

Une charge de travail typique de type chat. Disons 20 000 jetons mis en cache, 2 000 jetons d'entrée non mis en cache et 1 500 jetons de sortie par requête. Fable 5 : 10(0.002) + 1.0(0.02) + 50(0.0015) = 0,02 $ + 0,02 $ + 0,075 $ = 0,115 $. Fable 5.1 : 0,02 $ + 0,005 $ + 0,075 $ = 0,100 $. Économie : 13 %. Pour atteindre les 25 % d'Anthropic, la part mise en cache doit être plus importante par rapport à la sortie, par exemple 60 000 jetons mis en cache pour les mêmes 1 500 jetons de sortie, ce qui donne 0,155 $ contre 0,110 $, soit une économie de 29 %.

Une boucle agentique. Un agent qui relit un préfixe mis en cache de 150 000 jetons à chaque tour de 40 appels d'outil, ajoute 1 000 jetons non mis en cache par tour et produit 800 jetons de sortie par tour. Par tour sur Fable 5 : 10(0.001) + 1.0(0.15) + 50(0.0008) = 0,01 $ + 0,15 $ + 0,04 $ = 0,20 $. Sur Fable 5.1 : 0,01 $ + 0,0375 $ + 0,04 $ = 0,0875 $. Économie : 56 % par tour, avant l'écriture unique dans le cache. Sur 40 tours, cela représente 8,00 $ contre 3,50 $. Le "jusqu'à 45 %" d'Anthropic se situe confortablement dans cette fourchette une fois que vous ajoutez les écritures en cache et les tours non mis en cache que tout agent réel possède.

La règle qui en découle : l'économie est proportionnelle au rapport entre l'entrée mise en cache et la sortie. Les charges de travail qui génèrent beaucoup de sortie (longues générations à partir de courts prompts) remarquent à peine le changement. Les charges de travail qui sont fortement basées sur des préfixes (agents, RAG avec un grand contexte stable, bots de support multi-tours) voient l'effet complet.

Trois exemples de coût par tâche

Les trois exemples supposent Fable 5.1 aux tarifs standards, avec l'écriture en cache de 5 minutes payée une seule fois.

1. Une seule revue de code. 30 000 jetons d'entrée (la différence plus un prompt système), 4 000 jetons de sortie, pas de cache. Entrée 0,30 $, sortie 0,20 $. Total : 0,50 $. La même revue sur Opus 5 coûte 0,25 $. C'est le cas où Fable 5.1 est simplement deux fois plus cher, car rien n'est mis en cache.

2. Une conversation de support de 25 tours. Un prompt système stable de 12 000 jetons mis en cache une fois (0,15 $ pour l'écriture), puis 25 tours ajoutant chacun 300 jetons d'entrée non mis en cache et 250 jetons de sortie, avec le préfixe servi depuis le cache. Entrée non mise en cache sur toute la conversation : 7 500 jetons = 0,075 $. Lectures de cache : 25 x 12 000 = 300 000 jetons = 0,075 $. Sortie : 6 250 jetons = 0,3125 $. Total : environ 0,61 $. Sur Fable 5, les lectures de cache seules coûteraient 0,30 $, pour un total proche de 0,84 $.

3. Une construction agentique de deux heures. 120 tours d'appel d'outil contre un préfixe qui passe de 20 000 à 200 000 jetons (moyenne de 110 000 mis en cache), 1 500 jetons non mis en cache par tour, 1 200 jetons de sortie par tour, et environ six rafraîchissements de cache à mesure que le préfixe s'agrandit. Lectures de cache : 120 x 110 000 = 13,2 M jetons = 3,30 $. Entrée non mise en cache : 180 000 jetons = 1,80 $. Sortie : 144 000 jetons = 7,20 $. Écritures en cache : environ 660 000 jetons à 12,50 $ = 8,25 $. Total : environ 20,55 $. Sur Fable 5, les lectures de cache seraient de 13,20 $ au lieu de 3,30 $, pour un total proche de 30,45 $. Cela représente une économie de 33 % sur une exécution où la sortie reste le poste de dépense le plus important.

Remarquez dans l'exemple 3 que les écritures en cache sont désormais le deuxième coût le plus important. C'est le revers des lectures bon marché : un échec coûte 40 fois plus cher qu'un succès, donc tout ce qui réinitialise le cache en milieu de session (reconstruire le prompt système, modifier un tour précédent, changer le tableau d'outils) coûte beaucoup plus cher par rapport à l'état stable que sur Fable 5.

Les leviers qui influencent la facture

Effort. output_config.effort est le plus grand levier unique sur les jetons de sortie, et la sortie coûte 50 $ par million. La recommandation d'Anthropic pour Fable 5.1 est de commencer à high, et ils affirment que medium correspond approximativement à la qualité de Fable 5 à moindre coût, tandis que low est souvent compétitif avec Opus et Sonnet en termes de coût par tâche. Effectuez votre propre évaluation. La version bêta de l'effort par message vous permet de passer à low pour les tours de routine et de l'augmenter pour les tours difficiles sans réinitialisation du cache.

Maintenez le cache actif. Le mise en cache de prompt est la réduction. Avec des lectures à 0,25 $ et des écritures à 12,50 $, le seuil de rentabilité sur le TTL de 5 minutes est un succès. Pour les périodes d'inactivité entre cinq et soixante minutes, un réenvoi max_tokens: 0 de maintien en vie sur le TTL de 5 minutes est généralement moins cher que de payer le double de l'écriture pour le TTL d'une heure. Et la même discipline d'ajout seulement qui préserve les blocs de réflexion sur ce modèle préserve le cache : ne jamais reconstruire system ou tools en milieu de session, utiliser des messages système en cours de conversation pour les changements, et utiliser des messages limités au tour pour les rappels par tour.

Regroupez ce qui peut attendre. L'API par lots divise tout par deux, de sorte qu'une requête par lots Fable 5.1 coûte 5 $ et 25 $, soit le même prix que le prix synchrone d'Opus 5. Les évaluations, les compléments de données et le traitement nocturne des documents y ont leur place. Notez que les fallbacks sont refusés sur les lots, donc les éléments refusés nécessitent une nouvelle soumission manuelle.

Choisissez le niveau par itinéraire. La documentation d'Anthropic indique de commencer avec Opus 5 et de passer à Fable 5.1 lorsque Opus 5, même avec un effort plus élevé, ne suffit pas. Pour les itinéraires où Opus 5 réussit vos évaluations, vous payez le double pour rien. La comparaison Fable 5.1 vs Opus 5 examine la décision en fonction de la charge de travail.

Surveillez les frais d'outils. Chaque requête avec des outils comporte un prompt système d'utilisation d'outils caché. Anthropic publie le nombre pour Opus 5 (286 jetons) mais n'a pas encore publié de chiffre pour Fable 5.1, alors mesurez-le avec le point d'accès de comptage de jetons. Un ensemble d'outils de navigateur ajoute environ 6 600 jetons par requête et l'ensemble d'outils informatiques environ 4 500, le tout mis en cache après le premier envoi.

Les refus sont gratuits, les réessais ne le sont pas. Un refus de classificateur avant toute sortie n'est pas facturé. Un repli côté serveur facture les tarifs du modèle de repli pour le réessai, et le crédit de repli d'Anthropic rembourse le coût du cache pour le changement. Instrumentez les refus comme leur propre métrique afin de savoir quelle part de vos dépenses Fable 5.1 est servie par Opus 5.

La plupart des techniques générales de notre guide pour réduire une facture API Claude s'appliquent toujours, avec le calcul de lecture de cache déplacé en faveur de Fable 5.1.

Ce que vous ne pouvez pas obtenir avec Fable 5.1

Le mode rapide est disponible uniquement pour Opus 5 et Opus 4.8, à 10 $ et 50 $. Il n'y a aucun moyen de payer pour une sortie Fable 5.1 plus rapide. Le niveau de priorité (Priority Tier) n'est pas pris en charge sur Fable 5.1 ou Mythos 5.1, tandis que Fable 5 le conserve, de sorte que la planification de capacité d'entreprise qui en dépend doit rester sur Fable 5 ou passer à Opus 5. Et la rétention de données nulle n'est pas disponible sauf autorisation expresse d'Anthropic ; une organisation ZDR reçoit une erreur 400 sur chaque requête.

Vérification de vos dépenses réelles dans Apidog

La seule façon fiable de connaître le coût d'une requête est l'objet usage, et le moyen le plus rapide de le lire est une collection de tests. Dans Apidog, enregistrez votre prompt système de production comme une requête avec cache_control activé, envoyez-la deux fois, et ajoutez des assertions sur usage.cache_creation_input_tokens pour le premier envoi et usage.cache_read_input_tokens pour le second. Ajoutez ensuite un script post-réponse qui multiplie chaque champ par son tarif et enregistre un coût par requête. Exécutez la collection chaque fois que vous modifiez un prompt ou une définition d'outil, et vous détecterez une modification qui annule le cache avant qu'elle n'impacte la facture. Téléchargez Apidog pour le construire ; le guide pas à pas de l'API montre les requêtes exactes.

Tarification de Fable 5.1 dans les applications Claude

La tarification API est par jeton. Dans les applications Claude, Fable 5.1 est mesuré par plan. Les plans Max incluent les modèles Fable jusqu'à 50 % de la limite d'utilisation hebdomadaire sans frais supplémentaires, puis continuent sur des crédits d'utilisation. Les sièges Pro et Team standard mesurent Fable 5.1 via des crédits d'utilisation dès le premier message. Les sièges standard Enterprise nécessitent l'activation de crédits d'utilisation pour une utilisation au-delà des limites du plan, et les factures Enterprise basées sur l'utilisation sont aux tarifs API standard. Les requêtes que les garde-fous réacheminent vers un autre modèle ne sont pas facturées aux prix Fable. Le guide des chemins gratuits et les moins chers explique ce que cela signifie en pratique.

FAQ

Combien coûte Claude Fable 5.1 par million de jetons ? 10 $ pour l'entrée et 50 $ pour la sortie, inchangé par rapport à Fable 5. Les lectures de cache sont à 0,25 $ par million, les écritures de cache sont à 12,50 $ (5 minutes) et 20 $ (1 heure), et l'API par lots est à 5 $ et 25 $.

Claude Fable 5.1 est-il moins cher que Fable 5 ? Par jeton, non. En pratique, oui pour tout ce qui utilise la mise en cache de prompt, car les lectures de cache sont passées de 1 $ à 0,25 $ par million. Anthropic estime une réduction de 25 % sur les charges de travail typiques et jusqu'à 45 % sur les charges de travail agentiques. Les charges de travail axées sur la sortie ne voient que peu de changements.

Claude Fable 5.1 est-il moins cher qu'Opus 5 ? Sans cache, non : il est exactement deux fois plus cher. Avec cache, la situation s'inverse : un succès de cache de Fable 5.1 (0,25 $) coûte la moitié d'un succès de cache d'Opus 5 (0,50 $). La sortie est toujours de 50 $ contre 25 $, donc Opus 5 l'emporte sur tout itinéraire à forte production.

Claude Fable 5.1 dispose-t-il du mode rapide ou du niveau de priorité ? Non aux deux. Le mode rapide est uniquement pour Opus 5 et Opus 4.8. Le niveau de priorité est pris en charge sur Fable 5 mais pas sur Fable 5.1.

Y a-t-il une prime pour le contexte long sur Claude Fable 5.1 ? Non. La fenêtre complète de 1 million de jetons est facturée aux tarifs standards, et les réductions de cache et de lots s'y appliquent.

Combien coûte Claude Fable 5.1 sur Bedrock ou Google Cloud ? Ces plateformes fixent leurs propres prix et ajoutent une prime de 10 % pour les points de terminaison régionaux. La plateforme Claude sur AWS et Microsoft Foundry facture aux tarifs API standard via les unités de consommation Claude. Notre guide de disponibilité cloud couvre la configuration sur chacune d'elles.

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API