Le prix de Claude Fable 5 commence à 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie sur l'API Anthropic. C'est l'essentiel pour la plupart des gens qui veulent juste un chiffre, mais l'image complète comporte quelques éléments mobiles à connaître avant d'intégrer le modèle en production. Fable 5 a été lancé le 9 juin 2026, et Anthropic le positionne comme coûtant « moins de la moitié du prix de Claude Mythos Preview ». Ce guide passe en revue tous les leviers de coût : les tarifs de l'API, ce que vous payez sur les forfaits Pro et Max, trois exemples concrets avec de l'arithmétique réelle, et comment Fable 5 se positionne par rapport à des modèles moins chers comme Claude Opus 4.8. Si vous n'avez besoin que d'une vérification rapide des coûts, la section suivante la contient.
En bref
Claude Fable 5 coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie sur l'API. Du 9 au 22 juin 2026, il est inclus gratuitement dans les forfaits Pro, Max, Team et Enterprise basés sur le nombre de sièges. À partir du 23 juin 2026, l'utilisation sur ces forfaits sera déduite des crédits d'utilisation mesurés aux mêmes tarifs de jetons de 10 $/50 $.
Tarification de Claude Fable 5 en un coup d'œil
Voici les chiffres clés dans un seul tableau. La colonne « par 1K jetons » est le même prix exprimé en une unité plus petite, ce qui est pratique lorsque vous évaluez le coût d'une seule requête.
| Type de jeton | Prix par 1M jetons | Prix par 1K jetons | Notes |
|---|---|---|---|
| Entrée | 10,00 $ | 0,01 $ | Tout ce que vous envoyez : invite, message système, contexte, définitions d'outils |
| Sortie | 50,00 $ | 0,05 $ | Tout ce que le modèle génère, y compris le raisonnement et les appels d'outils |
L'ID du modèle API est claude-fable-5. Les jetons de sortie coûtent 5 fois plus cher que les jetons d'entrée, ce qui est normal pour les modèles de pointe d'Anthropic et influence la plupart des conseils d'optimisation ultérieurs dans cet article. Vous pouvez confirmer les tarifs actuels à tout moment sur la page de tarification d'Anthropic et dans les documents sur les modèles et la tarification.
Ce que vous payez sur l'API
Anthropic facture deux choses séparément, et vous payez pour les deux.
Les jetons d'entrée sont tout ce que vous envoyez au modèle lors d'une requête. Cela inclut votre texte d'invite, le message système, tout tour de conversation précédent que vous rejouez pour le contexte, les documents récupérés et le JSON pour tous les outils que vous définissez. Ceux-ci sont facturés à 10 $ par million, ou un centime par millier.

Les jetons de sortie sont tout ce que le modèle génère en retour. C'est la réponse visible plus tout raisonnement interne produit par le modèle et tous les arguments d'appel d'outils qu'il écrit. Ceux-ci sont facturés à 50 $ par million, ou cinq centimes par millier.
Ainsi, une seule requête qui envoie 2 000 jetons en entrée et reçoit 600 jetons en sortie vous coûte 2 000 jetons d'entrée plus 600 jetons de sortie, facturés à leurs tarifs séparés. Il n'y a pas de frais fixes par requête en sus. Votre facture est purement la somme des jetons d'entrée et de sortie pour chaque appel que vous effectuez.
Anthropic décrit Fable 5 comme « moins de la moitié du prix de Claude Mythos Preview », ce qui correspond au positionnement du modèle par rapport à la version d'aperçu précédente de niveau de pointe. Le modèle frère restreint, Claude Mythos 5, applique les mêmes tarifs de 10 $ en entrée et 50 $ en sortie, donc passer de l'un à l'autre ne modifie pas votre coût par jeton. Si vous souhaitez le contexte conceptuel sur le modèle lui-même avant de le budgétiser, qu'est-ce que Claude Fable 5 couvre les aspects liés aux capacités.
Inclusion dans le forfait vs crédits d'utilisation
La tarification sur l'API est une chose. Ce que vous payez dans le cadre d'un abonnement Claude suit un calendrier différent, et les dates sont importantes.
Du 9 au 22 juin 2026, Claude Fable 5 est inclus sans frais supplémentaires dans les forfaits Pro, Max, Team et Enterprise basés sur le nombre de sièges. Pendant cette période, vous pouvez utiliser le modèle sur ces forfaits sans que cela ne soit déduit d'un solde mesuré. Il s'agit d'une promotion de lancement, pas de l'état permanent.
Le 23 juin 2026, Fable 5 est retiré de l'ensemble inclus dans ces forfaits. Après cette date, l'utilisation de Fable 5 sur les forfaits Pro, Max, Team ou Enterprise basés sur le nombre de sièges sera déduite des crédits d'utilisation, ce qui signifie qu'elle sera mesurée aux mêmes tarifs de jetons de 10 $ en entrée et 50 $ en sortie par million que vous paieriez sur l'API brute. Anthropic a déclaré qu'il prévoyait de rétablir un accès standard au forfait lorsque la capacité le permettrait, de sorte que l'état post-23 juin pourrait s'assouplir plus tard, mais le comportement de facturation aux crédits est ce qu'il faut budgétiser pour l'instant.
Les forfaits Enterprise basés sur la consommation sont différents. Fable 5 y est entièrement disponible dès le lancement sans période d'inclusion à craindre, puisque ces forfaits facturent l'utilisation dès le départ. Si votre question d'accès est plus large que la facturation, comment accéder à Claude Fable 5 répertorie tous les points d'entrée.
La conclusion pratique : si vous prototypez sur un siège Pro ou Max cette semaine, vous avez carte blanche jusqu'au 22 juin. Planifiez vos expériences plus lourdes en conséquence, et si vous vous attendez à un trafic de production soutenu, modélisez vos coûts en fonction des tarifs API de 10 $/50 $ plutôt que de la fenêtre gratuite, car c'est ce que vous allez devoir payer.
Exemples concrets : ce que coûte une charge de travail réelle
Les chiffres par million de jetons sont abstraits. Voici trois charges de travail concrètes avec l'arithmétique détaillée, afin que vous puissiez y transposer votre propre utilisation.
La formule est la même à chaque fois : (jetons d'entrée / 1 000 000) * 10 $ plus (jetons de sortie / 1 000 000) * 50 $.
Exemple 1 : un tour de chatbot de support
Un tour typique de support client comporte des instructions système et un bref historique de conversation, puis renvoie une réponse ciblée. Disons 1 500 jetons d'entrée et 500 jetons de sortie.
- Entrée : 1 500 / 1 000 000 * 10 $ = 0,015 $
- Sortie : 500 / 1 000 000 * 50 $ = 0,025 $
- Total : 0,04 $ par tour
Quatre centimes par tour. Si ce chatbot gère 1 000 tours par jour, vous parlez d'environ 40 $/jour, soit environ 1 200 $/mois, avant l'application de tout levier de coût mentionné dans la section suivante. C'est une vérification utile : les charges de travail de type chat sur Fable 5 restent bon marché par appel mais s'accumulent en volume.
Exemple 2 : une requête de génération de code
La génération de code envoie généralement plus de contexte : le fichier que vous modifiez, les extraits de code associés et les instructions. Disons 8 000 jetons d'entrée et 3 000 jetons de sortie pour une fonction générée substantielle avec explication.
- Entrée : 8 000 / 1 000 000 * 10 $ = 0,08 $
- Sortie : 3 000 / 1 000 000 * 50 $ = 0,15 $
- Total : 0,23 $ par requête
Notez que même si vous avez envoyé près de 3 fois plus d'entrée que de sortie, la sortie domine toujours la facture à 0,15 $ sur les 0,23 $. Ce ratio de prix sortie/entrée de 5:1 explique pourquoi la réduction des générations verbeuses permet d'économiser de l'argent réel.
Exemple 3 : une exécution d'agent à long terme
Les exécutions d'agents qui lisent de grandes bases de code ou des documents et effectuent de nombreuses étapes augmentent considérablement l'entrée. Disons 300 000 jetons d'entrée (beaucoup de contexte récupéré rejoué à travers les étapes) et 50 000 jetons de sortie.
- Entrée : 300 000 / 1 000 000 * 10 $ = 3,00 $
- Sortie : 50 000 / 1 000 000 * 50 $ = 2,50 $
- Total : 5,50 $ par exécution
Une seule exécution d'agent approfondie coûte environ cinq dollars et demi. Exécutez cela 200 fois par jour au sein d'une équipe et vous arrivez à 1 100 $/jour. C'est précisément la charge de travail où la mise en cache des invites est rentable, car les agents rejouent le même grand contexte à plusieurs reprises. Nous allons quantifier cela ensuite.
Comment réduire votre facture Claude Fable 5
Une fois que vous avez décidé que Fable 5 est le bon modèle, voici les fonctionnalités standard de l'API Anthropic qui réduisent les coûts. Aucune d'entre elles ne nécessite un accès spécial.
- Mise en cache des invites. Les lectures du cache coûtent environ 0,1 fois le prix d'entrée, donc l'entrée mise en cache revient à environ 1 $ par million au lieu de 10 $. Les écritures dans le cache coûtent environ 1,25 fois l'entrée (environ 12,50 $ par million pour un TTL de 5 minutes), donc la mise en cache est rentable lorsque vous réutilisez le même contexte sur de nombreuses requêtes. Prenons l'exécution d'agent de l'exemple 3 : si 250 000 des 300 000 jetons d'entrée sont du contexte stable servi depuis le cache, cette entrée passe de 3,00 $ à environ 0,25 $ (250 000 lectures mises en cache à 1 $/M = 0,25 $, plus 50 000 nouvelles entrées à 10 $/M = 0,50 $). L'exécution totale passe de 5,50 $ à environ 3,25 $. Pour les agents et les chatbots qui rejouent une grande invite système, la mise en cache est le plus grand changement de coût que vous puissiez apporter.
- API de lots. Pour les tâches qui ne nécessitent pas de réponse immédiate, comme le traitement de documents pendant la nuit ou la classification en masse, l'API de lots fonctionne avec environ 50 % de réduction. Cela transforme les tarifs de 10 $/50 $ en environ 5 $/25 $, ce qui correspond à la tarification de niveau Opus pour une sortie de niveau Fable. Si votre travail tolère un délai, c'est presque de l'argent gratuit.
- Adapter la taille du modèle. Toutes les requêtes n'ont pas besoin de Fable 5. Dirigez le raisonnement difficile et nouveau vers Fable et envoyez le trafic de routine vers Opus 4.8, Sonnet 4.6 ou Haiku 4.5. Un routeur à plusieurs niveaux qui envoie 80 % des appels à un modèle moins cher peut à lui seul réduire une facture de plus de moitié.
- Réduire max_tokens. La sortie est le côté coûteux à 50 $ par million. Définissez
max_tokensà ce dont la tâche a réellement besoin au lieu de le laisser ouvert, et demandez des réponses concises dans l'invite. Réduire une génération de 3 000 jetons à 1 500 jetons divise par deux le coût de sortie de cet appel. - Diffuser les réponses en continu (Streaming). Le streaming ne modifie pas le prix par jeton, mais il vous permet d'arrêter la génération tôt une fois que vous avez ce dont vous avez besoin, et il améliore la latence perçue, de sorte que vous êtes moins tenté de faire trop de requêtes. Combiné à un
max_tokensstrict, il maintient les dépenses de sortie à un niveau raisonnable.
Suivez les dépenses de Claude Fable 5 avec Apidog
La manière la plus propre de maintenir la visibilité des coûts des jetons pendant le développement est de les surveiller à chaque requête, et non à la fin du mois lorsque la facture arrive. Apidog est un client API que vous pouvez utiliser pour envoyer des requêtes à l'API Anthropic et inspecter exactement ce qui est renvoyé.

Lorsque vous appelez claude-fable-5 via Apidog, le corps de la réponse inclut un objet usage avec input_tokens et output_tokens pour cette requête. La lecture de ces deux nombres vous indique le coût précis de l'appel : multipliez les jetons d'entrée par 0,00001 $ et les jetons de sortie par 0,00005 $, additionnez-les, et vous obtenez la facture de cette requête à la fraction de centime près. Faire cela pendant que vous itérez sur les invites vous montre immédiatement quand un changement fait exploser votre nombre de jetons, bien avant que cela n'apparaisse en production.
Un flux de travail pratique : configurez la requête de complétion de chat Anthropic dans Apidog, enregistrez quelques invites représentatives comme exemples, et comparez les nombres usage entre les variations d'invite. Vous verrez rapidement quelles modifications de message système ajoutent des centaines de jetons d'entrée et quelles modifications de format de réponse gonflent la sortie. Cette boucle de rétroaction est difficile à obtenir à partir du seul tableau de bord. Téléchargez Apidog pour configurer cela, et associez-le au guide de l'API Claude Fable 5 pour la structure de la requête. Si vous surveillez attentivement votre budget, comment utiliser Claude Fable 5 gratuitement couvre les voies sans frais pendant la période d'inclusion.
Apidog conserve également un historique des requêtes, ce qui vous permet de consulter les appels passés et leurs nombres de jetons lorsque vous estimez le coût d'une nouvelle fonctionnalité. Traiter Apidog comme votre couche d'inspection des coûts pendant le développement signifie qu'il n'y a pas de surprises de jetons lorsque le trafic augmente.
La tarification de Claude Fable 5 se résume à une simple paire de chiffres : 10 $ d'entrée et 50 $ de sortie par million de jetons, avec une période de forfait gratuit jusqu'au 22 juin et des crédits mesurés après le 23 juin. Le reste est une question de calcul de charge de travail et de quelques leviers de coût : mettez en cache votre contexte stable, traitez par lots ce qui n'est pas urgent, et passez à Opus 4.8 ou Sonnet 4.6 lorsque la tâche ne nécessite pas le niveau de pointe. Votre prochaine étape consiste à configurer une seule requête claude-fable-5 et à lire l'objet usage afin que vos estimations reposent sur des nombres de jetons réels. Téléchargez Apidog pour envoyer cette première requête et surveiller le coût en temps réel.
