Anthropic a lancé Claude Fable 5 le 9 juin 2026, avec un prix qui impose une véritable décision : la question Claude Fable 5 vs Opus 4.8 est, au fond, une question d'argent. Fable 5 coûte exactement deux fois plus cher par jeton qu'Opus 4.8. L'entrée coûte 10 $ par million de jetons contre 5 $ pour Opus 4.8, et la sortie coûte 50 $ par million contre 25 $. Donc, avant de lire une seule affirmation de référence, le calcul est clair : même fournisseur, même API Messages, et un surcoût de 2x pour le nouveau modèle. La partie intéressante est de déterminer quand ce surcoût est rentable, et quand vous brûlez de l'argent. Si vous souhaitez d'abord obtenir des informations complètes sur l'ancien modèle, notre guide sur Claude Opus 4.8 explique ce qu'il est et où il se situe dans la gamme.
TL;DR
Claude Fable 5 et Opus 4.8 sont de la même famille. Fable 5 coûte exactement 2x Opus 4.8 par jeton (10 $/50 $ contre 5 $/25 $). Pour la plupart des travaux de chat, de génération de code et de récupération, Opus 4.8 est le choix le plus judicieux. Optez pour Fable 5 lorsque vous avez besoin d'un travail autonome à très long terme qui reste cohérent sur des millions de jetons. Sinon, économisez de l'argent.

Claude Fable 5 vs Opus 4.8 en un coup d'œil
Voici la comparaison côte à côte pour que vous puissiez voir le compromis en un seul endroit.
| Dimension | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|
| ID du modèle API | claude-fable-5 |
claude-opus-4-8 |
| Prix d'entrée (par 1M jetons) | 10,00 $ | 5,00 $ |
| Prix de sortie (par 1M jetons) | 50,00 $ | 25,00 $ |
| Coût relatif | 2x Opus 4.8 | Référence |
| Contexte | Opère sur des millions de jetons ; aucun nombre fixe publié | Fenêtre de contexte de 1M de jetons |
| Réflexion et effort | Réflexion adaptative | Réflexion adaptative + effort (faible/moyen/élevé/très élevé/maximum) |
| Positionnement | Un modèle de classe Mythos rendu sûr pour un usage général ; le plus performant qu'Anthropic ait mis à disposition du public | Très performant ; était le modèle le plus performant d'Anthropic disponible pour le public avant Fable 5 |
| Idéal pour | Travaux autonomes à très long terme, migrations massives, agents multi-heures | La plupart des tâches de chat, de génération de code, de RAG et des charges de travail interactives |
Une note sur le contexte : Anthropic n'a pas publié de nombre exact pour la fenêtre de contexte de Fable 5. L'entreprise le décrit comme restant concentré sur des millions de jetons, il faut donc traiter son comportement de contexte long comme une force qualitative plutôt qu'une spécification que vous pouvez fixer. Opus 4.8, en revanche, a une fenêtre documentée de 1 million de jetons. Si votre décision dépend d'un chiffre de contexte précis, Opus 4.8 est celui dont le nombre peut être cité dans un document de conception ; les documents de présentation des modèles d'Anthropic listent les spécifications publiées pour la gamme. Pour une introduction en langage clair au nouveau modèle, notre explication de ce qu'est Claude Fable 5 couvre les bases, et notre analyse détaillée des prix d'Opus 4.8 approfondit l'aspect coût.
Prix : Fable 5 coûte exactement deux fois plus cher
C'est le fait le plus clair de toute la comparaison, alors commencez par là.
Fable 5 facture 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie. Opus 4.8 facture 5 $ par million d'entrée et 25 $ par million de sortie. Deux fois le taux d'entrée, deux fois le taux de sortie. Il n'y a pas d'astérisque, pas de réduction progressive qui modifie le ratio, et pas de supplément pour le contexte long qui le biaise. Fable 5 coûte 2x Opus 4.8 à tous les niveaux. Vous pouvez confirmer les tarifs actuels sur la page de tarification d'Anthropic.
Pour 1 000 jetons, cela correspond à :
- Fable 5 : 0,010 $ en entrée, 0,050 $ en sortie
- Opus 4.8 : 0,005 $ en entrée, 0,025 $ en sortie
Ces chiffres semblent minimes isolément, ce qui est exactement la façon dont les budgets échappent aux équipes. Le ratio est ce qui compte une fois que le volume augmente.
Prenons un exemple mensuel réaliste. Supposons qu'une fonctionnalité de production traite 200 millions de jetons d'entrée et génère 40 millions de jetons de sortie en un mois. Avec Opus 4.8, cela représente 200 x 5 $ + 40 x 25 $, soit 1 000 $ + 1 000 $ = 2 000 $. Avec Fable 5, la même charge de travail est de 200 x 10 $ + 40 x 50 $, soit 2 000 $ + 2 000 $ = 4 000 $. Mêmes jetons, même travail, 2 000 $ contre 4 000 $. Le surcoût augmente linéairement avec l'utilisation, donc une charge de travail qui s'exécute toute la journée, tous les jours, double sa facture de modèle dès que vous changez la chaîne du modèle.
Ce cadrage est important car la décision de mise à niveau n'est pas « Fable 5 est-il meilleur ? » Il l'est presque toujours. La décision est « Fable 5 est-il suffisamment meilleur pour justifier le doublement de ce poste budgétaire spécifique ? » Pour un outil interne à faible volume, 2 000 $ supplémentaires par mois pourraient être négligeables. Pour un point de terminaison client à fort volume, cela peut faire la différence entre une marge saine et une marge déficitaire. Évaluez le coût de la charge de travail, pas celui du modèle. Si vous souhaitez une analyse plus approfondie des coûts de l'option la moins chère, consultez notre analyse des prix d'Opus 4.8 ; pour la grille tarifaire spécifique du nouveau modèle, notre guide de tarification de Claude Fable 5 contient les détails.
Capacité : là où Fable 5 prend l'avantage
Fable 5 n'est pas un simple relooking marketing d'Opus 4.8. C'est un modèle véritablement plus performant, et l'écart se manifeste le plus clairement dans les travaux autonomes et de longue haleine.
Dans son annonce de Claude Fable 5, Anthropic décrit Fable 5 comme un modèle de classe Mythos rendu sûr pour un usage général, le modèle le plus performant que l'entreprise ait mis à la disposition du public. Il est conçu pour un travail autonome à très long terme et reste concentré sur des millions de jetons. Cette dernière phrase est tout l'argumentaire de vente. De nombreux modèles peuvent écrire une bonne fonction ou répondre à une question. Beaucoup moins peuvent fonctionner pendant des heures, maintenir un plan cohérent sur une quantité énorme de contexte, et prendre encore de bonnes décisions à la fin.
La démonstration la plus claire est le résultat obtenu avec Stripe. Fable 5 a réalisé une migration de base de code Ruby de 50 millions de lignes pour Stripe en une seule journée, un travail que l'équipe estimait devoir prendre deux mois ou plus. Ce n'est pas une abstraction de benchmark. C'est une véritable migration d'une base de code réelle à une échelle où le goulot d'étranglement est la cohérence soutenue, et non la qualité brute par jeton. Un modèle qui dérive ou perd le fil après quelques centaines de milliers de jetons ne peut pas effectuer ce travail, quel qu'en soit le prix. C'est pour ce type de charge de travail que Fable 5 a été conçu.
La mémoire amplifie l'écart. Lors d'un test Slay the Spire, donner à Fable 5 une mémoire de fichier persistante a produit une amélioration de 3x par rapport à Opus 4.8. La leçon se généralise bien au-delà d'un jeu de cartes : lorsqu'une tâche s'étend sur de nombreuses étapes et que le modèle peut s'écrire des notes et les relire, Fable 5 capitalise sur cette mémoire pour obtenir des résultats nettement meilleurs sur de longues périodes. Si votre agent maintient un bloc-notes, un fichier de plan ou un stockage de mémoire structuré au cours d'une longue session, c'est exactement la configuration où la force de Fable 5 à long terme se traduit par des gains mesurables.
Sur les benchmarks, Fable 5 a atteint des placements de pointe sur presque tous. Il a dominé FrontierCode et FrontierBench de Cognition, CursorBench et le Finance Benchmark de Hebbia, entre autres. Anthropic n'a pas publié de scores publics pour ceux-ci, il faut donc traiter les placements comme une indication plutôt que comme des chiffres à citer. Le schéma est cohérent : Fable 5 est en tête des évaluations de codage, d'agent et de finance. Le point à retenir n'est pas un delta de classement ; c'est que le modèle se positionne au sommet ou près du sommet des tâches difficiles et multi-étapes qui correspondent à des travaux réels coûteux.
Une dernière chose à savoir pour une comparaison équitable : Fable 5 est livré avec des garde-fous qui redirigent certaines requêtes sensibles (cybersécurité, biologie et chimie, et demandes de distillation de modèles) vers Opus 4.8 au lieu d'y répondre directement. Anthropic affirme que cela se produit dans moins de 5 % des sessions, donc cela affecte rarement l'utilisation normale, mais c'est une réelle différence de comportement. Pour la plupart des charges de travail, vous ne le verrez jamais. Pour une comparaison directe avec d'autres fournisseurs, notre comparaison d'Opus 4.8 avec GPT-5.5 et Gemini 3.5 et l'article correspondant Fable 5 versus GPT-5.5 et Gemini 3.5 confrontent chaque modèle à un champ plus large.
Quand Opus 4.8 est le meilleur choix
Voici la partie que les annonces de lancement ont tendance à omettre : pour une grande partie du travail de production, Opus 4.8 est le meilleur choix économique, et ce n'est pas une mince affaire.
Opus 4.8 était le modèle le plus performant d'Anthropic disponible pour le public avant l'arrivée de Fable 5. Il n'est pas devenu moins bon le jour où Fable 5 a été lancé. Il reste un modèle puissant de premier ordre avec une fenêtre de contexte documentée de 1 million de jetons, une pensée adaptative et toute la gamme d'efforts, de faible à maximum. Pour la plupart des interfaces de chat, de la génération de code et de la génération augmentée de récupération, Opus 4.8 produit d'excellents résultats à la moitié du coût par jeton. Si la tâche tient confortablement dans un million de jetons et se résout en un seul tour ou une courte boucle, vous payez très probablement le double pour une capacité que vous n'utiliserez pas si vous choisissez Fable 5.
Trois types de charges de travail penchent fortement en faveur d'Opus 4.8 :
- Le chat interactif et les assistants, où chaque tour est court, la latence est importante, et le modèle a rarement besoin de maintenir un plan sur plusieurs heures.
- La génération et la révision de code au niveau de la fonction, du fichier ou de la pull request, où le contexte est limité et la tâche se termine rapidement.
- Le RAG et les questions-réponses sur documents, où vous insérez le contexte pertinent dans une fenêtre de 1 million de jetons et posez une question ciblée. La fenêtre est l'atout ici, et Opus 4.8 la possède.
Il y a aussi un argument discrètement persuasif caché dans la conception même de Fable 5. Lorsque Fable 5 atteint l'une de ses catégories de sauvegarde, il redirige la requête vers Opus 4.8. Le nouveau modèle se replie littéralement sur l'ancien pour les cas sensibles. C'est un signal fort qu'Opus 4.8 est fiable, compétent et suffisamment bon pour remplacer le modèle phare sur du trafic réel. S'il est le filet de sécurité sous le modèle le plus cher qu'Anthropic vend, il est plus que suffisant pour la majeure partie de vos requêtes quotidiennes.
Le défaut sensible au coût est donc simple : commencez avec Opus 4.8, mesurez, et ne mettez à niveau que les charges de travail spécifiques qui prouvent qu'elles ont besoin d'une autonomie à long terme. Si même Opus 4.8 est plus que ce qu'une charge de travail requiert, Claude Sonnet 4.6 se situe en dessous avec 3 $ en entrée et 15 $ en sortie, et gère les tâches plus simples à fort volume pour une fraction du coût. Pour les détails de configuration des niveaux Claude moins chers, notre guide API Opus 4.8 explique les appels.
Un cadre de décision : lequel choisir ?
Oubliez les impressions et dirigez-vous par charge de travail. Ces règles couvrent la plupart des cas réels.
- Tâches courtes et à un seul tour (chat, classification, extraction, un court extrait de code) : Utilisez Opus 4.8. Le surcoût de 2x ne vous apporte rien ici car la tâche n'exploite jamais l'avantage de Fable 5 sur le long terme.
- Génération et révision de code limitées (une fonction, un fichier, une PR) : Utilisez Opus 4.8. Résultats solides, moitié prix, et le contexte correspond.
- RAG, questions-réponses sur documents et analyse dans une fenêtre de 1 million de jetons : Utilisez Opus 4.8. La fenêtre documentée d'un million de jetons est la fonctionnalité pour laquelle vous payez, et Opus 4.8 la possède.
- Agents autonomes de plusieurs heures qui doivent rester cohérents sur une très longue durée : Utilisez Fable 5. C'est la charge de travail pour laquelle il a été conçu, et l'écart de cohérence justifie le prix.
- Migrations et refactorisations massives couvrant une énorme base de code en une seule fois : Utilisez Fable 5. La migration de 50 millions de lignes de Stripe en est l'exemple. À cette échelle, la concentration soutenue est le goulot d'étranglement, et Fable 5 le résout.
- Agents de longue durée avec mémoire persistante : Utilisez Fable 5. Le résultat de mémoire 3x indique que le rendement cumulé sur de longues sessions est réel.
- Le coût est la contrainte principale : Utilisez Opus 4.8, ou passez à Sonnet 4.6 pour les tâches simples à fort volume. Réservez Fable 5 pour les rares tâches qui en ont réellement besoin.
La méta-règle : par défaut, utilisez Opus 4.8, puis ne promouvez les charges de travail individuelles vers Fable 5 que lorsqu'elles démontrent un besoin d'autonomie à long terme. Doubler les coûts pour l'ensemble parce qu'un seul travail en bénéficie est le moyen le plus courant pour les équipes de dépenser trop pour un modèle phare.
Basculer entre les deux dans le code
La bonne nouvelle pour quiconque évalue cette décision : le basculement est trivial. Les deux modèles se trouvent derrière la même API Messages. Il n'y a pas de migration de SDK, pas de nouveau flux d'authentification, pas de corps de requête remodelé. Vous changez la chaîne d'identifiant du modèle et rien d'autre. claude-fable-5 pour le nouveau modèle, claude-opus-4-8 pour le moins cher.
import anthropic
client = anthropic.Anthropic()
# Par défaut, moins cher, de niveau frontière
response = client.messages.create(
model="claude-opus-4-8", # passer à "claude-fable-5" pour le modèle phare
max_tokens=16000,
thinking={"type": "adaptive"},
messages=[{"role": "user", "content": "Résume ce document de conception et liste les questions ouvertes."}],
)
for block in response.content:
if block.type == "text":
print(block.text)
Puisque la seule différence est la chaîne du modèle, vous pouvez acheminer par requête. Envoyez le trafic quotidien à claude-opus-4-8, et changez la chaîne en claude-fable-5 pour la poignée de tâches qui nécessitent une autonomie à long terme, tout cela à partir du même client et du même chemin de code. Cela rend une stratégie par défaut à faible coût et de mise à niveau à la demande facile à implémenter : une seule valeur de configuration ou une condition d'une ligne décide quel modèle gère une requête donnée. Pour la surface complète de la requête sur l'ancien modèle, consultez notre guide détaillé de l'API Opus 4.8 ; le guide de l'API Fable 5 correspondant couvre le nouveau modèle.
Comparez-les vous-même avec Apidog
Les tableaux de prix et les affirmations de benchmarks ne vous mènent que jusqu'à un certain point. La manière honnête de résoudre la question Claude Fable 5 vs Opus 4.8 pour votre charge de travail est d'envoyer la même invite aux deux identifiants de modèle et d'examiner ce qui en ressort. C'est un travail qu'Apidog gère proprement.
Configurez une requête contre l'API Messages d'Anthropic, puis dupliquez-la et ne modifiez que le champ du modèle, claude-fable-5 dans l'une, claude-opus-4-8 dans l'autre. Envoyez les deux avec une invite qui ressemble réellement à votre trafic de production, et non à une question gadget. Comparez ensuite les deux réponses côte à côte : quelle réponse est la plus correcte, quelle est la plus complète, et si l'écart de qualité est suffisamment important pour votre cas d'utilisation.
Apidog met également en évidence les chiffres qui sous-tendent la décision de coût. Vous pouvez surveiller la latence de chaque appel et lire l'utilisation des jetons directement à partir de chaque réponse, y compris les compteurs d'entrée et de sortie qui déterminent ce que vous paierez réellement. Mettez l'utilisation des deux modèles à côté de la différence de qualité, et le surcoût de 2x cesse d'être abstrait. Vous pouvez voir, pour votre invite réelle, si la sortie de Fable 5 vaut les jetons et les dollars supplémentaires ou si Opus 4.8 fait déjà le travail. Enregistrez les deux requêtes comme une petite collection et vous disposez d'un banc d'essai A/B reproductible que vous pouvez réexécuter chaque fois que vos invites changent ou qu'un nouveau modèle arrive. Si vous souhaitez l'essayer, Téléchargez Apidog et construisez les deux requêtes en quelques minutes. C'est un chemin plus rapide vers une réponse confiante que de lire une autre fiche technique, et Apidog maintient l'ensemble de la comparaison au même endroit.

