Claude Opus 5 est sorti le 24 juillet 2026 et il a été intégré à Claude Code dès le premier jour. Si vous payez pour Max, c'est déjà votre modèle par défaut. Si vous êtes sur Pro, c'est maintenant le modèle le plus puissant auquel vous pouvez accéder. Et si vous utilisez Claude Code avec une clé API, cela coûte 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, comme pour Opus 4.8.
Ce que personne ne vous a dit, c'est que votre configuration existante risque de vous désavantager. Opus 5 vérifie son propre travail sans qu'on le lui demande, écrit plus long par défaut, et a recours aux sous-agents plus facilement qu'Opus 4.8. Chacun de ces comportements est un comportement que votre fichier CLAUDE.md soigneusement ajusté peut amplifier plutôt que corriger.
Ce guide couvre la sélection de modèles, les changements par niveau d'abonnement, le comportement de l'effort, et les quatre modifications d'invite à effectuer dès le premier jour. Vous verrez également comment l'associer à Apidog afin que le modèle teste l'API qu'il vient d'écrire au lieu de supposer qu'elle fonctionne. Pour une analyse complète du modèle, commencez par notre aperçu de Claude Opus 5, et consultez l'annonce de Claude Opus 5 d'Anthropic pour les spécifications sources.
bouton
Ce qui change par niveau d'abonnement
L'accès a évolué d'une manière plus significative que d'habitude.
Abonnés Max : Opus 5 devient votre modèle par défaut. Vous n'avez rien à faire. Ouvrez une session et vous l'utilisez. La conséquence pratique est que votre mémoire musculaire concernant les coûts et la verbosité est maintenant calibrée sur un modèle que vous n'utilisez plus.

Abonnés Pro : Opus 5 est désormais le modèle le plus performant qui vous est accessible. C'est un réel changement dans ce qu'un abonnement Pro vous offre. Auparavant, le haut de votre pile était un cran en dessous du niveau de pointe ; maintenant, c'est le modèle par défaut recommandé par Anthropic dans sa propre documentation.
Utilisateurs de clés API : Opus 5 est disponible sur l'API Claude, Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry et GitHub Copilot. Le prix est de 5 $ en entrée et 25 $ en sortie par million de jetons, inchangé par rapport à Opus 4.8 et la moitié du prix de Fable 5 (10 $/50 $). Notre analyse des prix d'Opus 5 contient le tableau complet, y compris les tarifs de mise en cache et de traitement par lots.

Une spécification à connaître avant de commencer : Opus 5 a une date limite de connaissances de mai 2026, la plus récente de tous les modèles Claude actuels. Fable 5 et Sonnet 5 s'arrêtent tous deux en janvier 2026. Pour un outil de codage qui passe sa journée à travailler avec des API de bibliothèques sorties le trimestre dernier, cinq mois de données d'entraînement supplémentaires ne sont pas négligeables.
Sélectionner Opus 5 dans Claude Code
La sélection du modèle s'effectue via la commande /model. Au sein d'une session :
/model
Vous obtenez un sélecteur listant les modèles disponibles. Choisissez Claude Opus 5.
Pour le définir sans ouvrir le sélecteur, passez l'ID directement :
/model claude-opus-5
L'ID exact du modèle API est claude-opus-5. Pas de suffixe de date, pas de marqueur de version. Si vous scriptiez Claude Code, définissiez un projet par défaut ou écriviez des fichiers de règles qui nomment le modèle, utilisez cette chaîne exactement. La documentation d'aperçu des modèles d'Anthropic liste les ID par plateforme si vous êtes sur Bedrock ou Google Cloud.
Le contexte est de 1M de jetons par défaut et au maximum, sans en-tête bêta et sans surcoût pour le contexte long. La sortie maximale est de 128k sur l'API Messages. Pour Claude Code, cela signifie que de grands dépôts tiennent, bien que le fait de tout alimenter à chaque tour gaspille toujours de l'argent. Notre aide-mémoire Claude Code couvre le reste des commandes slash.
Comment l'effort se comporte
La presse l'a qualifié de bascule entre le coût et la capacité. Ce qu'il est réellement : output_config.effort, un paramètre API avec cinq niveaux (low, medium, high, xhigh, max), que les interfaces utilisateur exposent comme un sélecteur d'effort.
Trois choses à savoir à ce sujet sur Opus 5.
Le défaut est high. Pas medium, pas adaptatif sans limite inférieure. Si vous envoyez une requête et ne dites rien sur l'effort, vous obtenez high.
Les niveaux sont recalibrés. Anthropic indique clairement de ne pas reporter vos paramètres d'effort d'Opus 4.8. Effectuez une nouvelle évaluation sur vos propres tests. Le changement spécifique à prendre en compte est que low et medium sont significativement plus puissants sur Opus 5 que sur tout modèle Opus précédent. Le travail que vous n'auriez jamais confié à medium sur 4.8 pourrait très bien fonctionner maintenant, avec une économie de coûts réelle. Pour le codage et le travail d'agent, xhigh reste le point de départ recommandé par Anthropic.
Un 400 vous attend. La combinaison de thinking: {type: "disabled"} avec un effort xhigh ou max renvoie une erreur 400, appliquée par requête. Claude Code gère la forme de la requête pour vous, donc vous ne la déclencherez pas dans une session interactive. Vous la déclencherez dès que vous scriptiez Claude Code ou construirez avec le SDK avec la réflexion désactivée et l'effort augmenté. La solution est de choisir : soit laisser la réflexion activée et réduire l'effort, soit maintenir l'effort plafonné à high.
Laissez la réflexion activée, d'ailleurs. Avec la réflexion désactivée, deux artefacts apparaissent occasionnellement sur Opus 5 : des appels d'outils écrits en texte brut qui ne s'exécutent jamais (et le texte divulgué empoisonne ensuite les tours ultérieurs dans une boucle agentique), et des balises XML internes apparaissant dans la sortie visible. La propre atténuation d'Anthropic consiste à laisser la réflexion activée et à contrôler les coûts par un effort moindre à la place. Notre guide des paramètres d'effort explique comment effectuer une évaluation, et le guide de migration couvre le reste des changements majeurs d'Opus 4.8.
Quatre modifications d'invites à effectuer dès le premier jour
C'est la section qui vous fera économiser le plus d'argent et d'irritation. Tout cela provient du guide de prompt d'Opus 5 d'Anthropic, qui mérite d'être lu entièrement.
1. Supprimez vos instructions de vérification
Si votre CLAUDE.md contient des phrases telles que "toujours vérifier votre travail", "vérifier le changement avant de rapporter" ou "confirmer que les tests réussissent puis confirmer à nouveau", retirez-les.
Opus 5 vérifie son propre travail sans qu'on le lui demande. C'est un comportement appris, que vous n'avez pas besoin de solliciter. Lorsque vous le demandez en plus, vous obtenez une sur-vérification : le modèle relit des fichiers qu'il a déjà lus, relance des vérifications qu'il a déjà effectuées, et brûle des jetons à confirmer des choses qu'il avait déjà confirmées. Les directives d'Anthropic sont explicites quant à la suppression de ces instructions.
La plupart des utilisateurs de Claude Code ont accumulé ces lignes pendant des mois de travail avec des modèles antérieurs qui avaient réellement besoin de cette impulsion. Elles sont maintenant un fardeau. Ouvrez votre fichier CLAUDE.md de projet et votre fichier global, recherchez "vérifier", "double-vérifier" et "confirmer", et supprimez ce que vous trouvez.
2. Limitez la génération de sous-agents
Opus 5 délègue plus facilement aux sous-agents qu'Opus 4.8. Pour une tâche de recherche importante et parallélisable, c'est une fonctionnalité. Pour une charge de travail sensible aux coûts, c'est une facture.
Définissez-le explicitement. Quelque chose comme ceci dans vos instructions de projet fonctionne :
## Délégation
Ne générez pas de sous-agents pour les tâches qu'un seul passage peut accomplir.
Utilisez au maximum deux sous-agents parallèles. Si une tâche semble en nécessiter
davantage, décrivez la répartition et demandez avant de générer.
Le but n'est pas d'empêcher la délégation. C'est de faire en sorte que le modèle la justifie plutôt que d'y recourir par défaut. Si vous construisez délibérément une configuration de sous-agents, notre guide sur la création de sous-agents Claude Code couvre la structure.
3. Demandez explicitement la concision
Les réponses par défaut et les livrables écrits d'Opus 5 sont plus longs que ceux d'Opus 4.8. Des résumés plus longs, des explications plus longues, des documents plus longs lorsque vous lui demandez d'écrire des documents.
Voici le piège : la diminution de l'effort ne corrige pas cela. L'effort contrôle la profondeur de la réflexion, pas la longueur de la sortie visible. Réduire à medium en s'attendant à des réponses plus courtes ne vous donnera que le même mur de texte avec moins de raisonnement derrière.
La longueur est désormais un contrôle au niveau de l'invite. Indiquez-le :
## Style de réponse
Rendez les résultats en moins de 150 mots, sauf si je demande des détails.
Pas de résumé de ce que vous venez de faire si je peux voir le diff.
Passez l'introduction. Commencez par la réponse.
4. Limitez explicitement les tâches étroites
Opus 5 étend la portée des tâches plus que son prédécesseur et narre ses corrections au fur et à mesure. Demandez-lui de corriger une fonction et il peut raisonnablement décider que le module environnant nécessite également une attention.
Lorsque vous voulez qu'une seule chose soit modifiée, dites-le comme une limite plutôt que comme une description. "Corrigez la vérification de nullité dans parseConfig et ne changez rien d'autre" est lu différemment par le modèle que "corrigez la vérification de nullité dans parseConfig." Notre article plus approfondi sur l'incitation d'Opus 5 contient des extraits à copier-coller pour chacun de ces comportements.
Construire une API, puis laisser Opus 5 la tester
Claude Code peut échafauder vos routes. Il ne peut pas voir si le point d'accès en cours d'exécution se comporte comme le contrat le stipule. Cet écart est l'endroit où se nichent la plupart des bogues "ça avait l'air correct", et il est plus large maintenant que le modèle vérifie son propre raisonnement avec confiance.
Concevez et maquettez d'abord l'API dans Apidog : points de terminaison, schémas de requête et de réponse, et un serveur de maquette renvoyant des données réalistes. Ensuite, pendant qu'Opus 5 écrit l'implémentation, dirigez-le vers la spécification réelle via le serveur Apidog MCP afin qu'il lise le schéma réel au lieu d'en inférer un. Une fois terminé, demandez-lui d'exécuter le scénario de test :
apidog run --access-token $APIDOG_TOKEN \
--project-id $PROJECT_ID \
--test-scenario "user-signup-flow"
Les assertions échouées reviennent sous forme de sortie que le modèle peut lire et sur laquelle il peut agir. C'est une boucle de vérification basée sur quelque chose d'externe, ce qui a plus de valeur que l'auto-vérification, quelle que soit la qualité de l'auto-vérification du modèle.
La même configuration est utile si vous appelez directement l'API Claude depuis votre code. Vous pouvez envoyer des requêtes claude-opus-5 depuis Apidog, observer les événements de streaming SSE arriver, inspecter les charges utiles des appels d'outils, stocker votre clé API comme variable d'environnement au lieu de la coller dans un script, exécuter la même invite à deux niveaux d'effort côte à côte, et lire le bloc usage pour confirmer que les hits du cache sont pris en compte. Téléchargez Apidog pour configurer le projet localement.
Le plafond honnête
Opus 5 n'est pas le sommet de la pile Claude, et il est bon d'être clair à ce sujet avant de vous engager dans une charge de travail.
Fable 5 détient toujours la désignation "modèle le plus performant largement diffusé" d'Anthropic. Et Opus 5 est en deçà de Mythos 5 en matière d'exploitation de la cybersécurité et de recherche en biologie autonome ; Anthropic le déclare elle-même plutôt que nous l'inférons. Si votre travail Claude Code se situe dans l'un de ces domaines, Opus 5 n'est pas le bon plafond. Notre explication sur les modèles de classe Mythos couvre à quoi sert ce niveau.
Concernant les affirmations sur les benchmarks : Anthropic rapporte qu'Opus 5 fait plus que doubler le score Frontier-Bench v0.1 d'Opus 4.8, atteint environ 3 fois le meilleur modèle suivant sur ARC-AGI 3, et se rapproche à 0,5 % du pic de Fable 5 sur CursorBench 3.2 pour la moitié du prix. Ce sont des chiffres fournis par le fournisseur. Au 25 juillet 2026, aucun n'a été reproduit indépendamment. Considérez-les comme une raison d'exécuter votre propre évaluation, et non comme un résultat définitif.
Le résumé juste est une capacité de pointe pour la moitié du prix de pointe, avec un plafond nommé au-dessus. C'est une bonne affaire. Ce n'est juste pas la même affirmation que "le meilleur modèle disponible".
Quand utiliser autre chose
Restez sur Opus 5 pour la plupart des tâches de Claude Code : codage agentique, refactorisations multi-fichiers, tâches à long terme, tout ce où le modèle exécute des commandes et lit la sortie en boucle.
Orientez-vous ailleurs lorsque la charge de travail est à volume élevé et dominée par les coûts, lorsque Sonnet 5 couvre l'édition standard à un tarif inférieur, ou lorsque vous êtes sur le territoire de Fable 5 ou Mythos 5 pour les problèmes frontaliers les plus difficiles. Le changement se fait par une commande : /model claude-sonnet-5 pour la partie bon marché, /model claude-opus-5 pour la partie difficile. Si vous utilisiez auparavant Sonnet 5 dans Claude Code ou Fable 5 dans Claude Code, le flux de travail vous semblera familier.
Conseils pratiques
- Vérifiez
CLAUDE.mden premier. Supprimez les instructions de vérification, ajoutez une contrainte de longueur, ajoutez un plafond de délégation. Quinze minutes, et cela change chaque session ensuite. - Réévaluez l'effort. Vos paramètres 4.8 sont obsolètes.
lowetmediumpeuvent désormais gérer des tâches que vous leur auriez refusées. - Laissez la réflexion activée. Contrôlez les coûts avec l'effort, pas en désactivant la réflexion. Les artefacts de réflexion désactivée sont pires que les économies de jetons.
- Délimitez votre contexte. 1M de jetons, c'est beaucoup d'espace, pas une raison de vider le dépôt à chaque tour.
- Vérifiez en externe. L'auto-vérification est bonne ; un test échoué contre un contrat réel est meilleur.
FAQ
Claude Opus 5 est-il disponible dans Claude Code ?
Oui, depuis sa sortie le 24 juillet 2026. Sélectionnez-le avec /model et choisissez Claude Opus 5, ou passez directement l'ID avec /model claude-opus-5. C'est le modèle par défaut pour les abonnés Max et le modèle le plus performant disponible pour les abonnés Pro.
Dois-je modifier mon CLAUDE.md pour Opus 5 ?
Probablement. Le guide d'incitation d'Anthropic indique que les instructions de vérification reportées entraînent une sur-vérification sur Opus 5, car il vérifie son propre travail sans y être invité. Supprimez-les. Ajoutez également une instruction explicite de concision (les réponses par défaut sont plus longues) et une limite de sous-agents (il délègue plus facilement).
Pourquoi la réduction de l'effort n'a-t-elle pas raccourci les réponses ?
L'effort contrôle la profondeur de la réflexion, pas la longueur de la sortie visible. Le réduire diminue les jetons de raisonnement tout en laissant la réponse à peu près aussi longue. Si vous voulez une sortie plus courte, demandez-le dans l'invite.
Qu'est-ce qui provoque une erreur 400 lorsque je règle l'effort sur xhigh ?
La combinaison de thinking: {type: "disabled"} avec un effort xhigh ou max renvoie une erreur 400 sur Opus 5, appliquée par requête. Soit activez la réflexion, soit plafonnez l'effort à high. Consultez le guide de migration pour les autres changements majeurs d'Opus 4.8.
Puis-je utiliser Opus 5 dans Claude Code avec un forfait gratuit ?
Opus 5 est disponible sur les abonnements Pro et Max et via l'API. Pro y accède en tant que modèle supérieur de ce niveau ; Max l'obtient par défaut. Notre guide d'accès gratuit à Opus 5 couvre les chemins honnêtes et les options payantes les moins chères.
