Claude Opus 5 est le tout dernier modèle de la série Opus d'Anthropic, lancé le 24 juillet 2026. Anthropic le positionne pour le codage agentique complexe et le travail en entreprise, et la documentation le nomme désormais le point de départ par défaut : si vous n'êtes pas sûr du modèle à utiliser, commencez par Claude Opus 5. Le chiffre clé est le prix. Opus 5 coûte 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, soit le même tarif qu'Opus 4.8 et la moitié de ce que Fable 5 facture.
Ce guide couvre les spécifications, le rapport prix-performance, les références de lancement d'Anthropic et leur fiabilité, les deux changements d'API qui cassent le code existant d'Opus 4.8, où vous pouvez exécuter le modèle, et la limite qu'Anthropic annonce clairement. Si vous appelez le modèle via HTTP, vous pouvez envoyer et inspecter ces requêtes dans Apidog au fur et à mesure.
Claude Opus 5 en un coup d'œil
| Spécification | Valeur |
|---|---|
| ID de modèle API | claude-opus-5 (sans suffixe de date) |
| Lancé le | 24 juillet 2026 |
| Fenêtre de contexte | 1 000 000 de jetons, par défaut et maximum |
| Sortie maximale | 128 000 jetons sur l'API Messages ; 300 000 sur l'API de traitement par lots avec l'en-tête bêta output-300k-2026-03-24 |
| Tarification de base | 5 $ par million de jetons d'entrée, 25 $ par million de jetons de sortie |
| Date limite de connaissance | Mai 2026 |
| Pensée adaptative | Activé par défaut |
| Niveaux d'effort | low, medium, high, xhigh, max ; par défaut à high |
| Niveau de priorité | Non pris en charge |
| Disponibilité | API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plateforme Claude sur AWS, Google Cloud, Microsoft Foundry, GitHub Copilot |
Trois de ces lignes méritent un deuxième examen.
La fenêtre de contexte de 1M est à la fois par défaut et maximale, et elle ne nécessite pas d'en-tête bêta. Il n'y a pas non plus de prime de contexte long, donc une invite de 900 000 jetons est facturée au même tarif par jeton qu'une invite de 900 jetons.
La date limite de connaissance de mai 2026 est la plus récente de tous les modèles Claude actuels. Fable 5 et Sonnet 5 sont tous deux à janvier 2026, donc Opus 5 connaît environ quatre mois supplémentaires de bibliothèques, de versions et de changements d'API sans que vous ayez à les coller.
Le Niveau de Priorité est la seule fonctionnalité qui a régressé. Opus 4.8 le prend en charge ; Opus 5 non. Si la planification de la capacité de votre entreprise dépend du Niveau de Priorité, c'est une véritable contrainte et elle est couverte dans le guide de migration.
Pour le tableau complet des modèles et chaque champ textuellement, l'aperçu des modèles d'Anthropic est la source officielle.
Ce qu'est Claude Opus 5
Opus 5 est le successeur de Claude Opus 4.8. L'ID du modèle API est la chaîne exacte claude-opus-5. Sur Amazon Bedrock, l'ID est anthropic.claude-opus-5, et sur Google Cloud, c'est à nouveau claude-opus-5. La plateforme Claude sur AWS utilise l'ID propriétaire.

La série Opus a toujours été la gamme puissante d'Anthropic, se situant au-dessus de Sonnet et en dessous des modèles de pointe en recherche Fable et Mythos. Ce qui a changé avec Opus 5, c'est que cette série a cessé d'être l'option coûteuse vers laquelle on escalade. La documentation d'Anthropic vous dit maintenant de commencer ici, ce qui est une position différente de la génération 4.x, où Sonnet était le modèle par défaut et Opus était la mise à niveau.
Le modèle devient également la valeur par défaut pour les abonnés Max et le modèle le plus performant disponible sur Pro, ce qui est la première fois qu'un modèle de classe Opus est le plafond pour un plan consommateur à prix moyen. L'article sur les chemins gratuits et les moins chers explique ce que cela vous apporte réellement.
Le rapport prix-performance
C'est la partie sur laquelle chaque article de lancement a mis l'accent, et elle se confirme lorsque vous consultez la page de tarification.
| Tarif | Entrée (par M jetons) | Sortie (par M jetons) |
|---|---|---|
| Standard | 5,00 $ | 25,00 $ |
| API par lots (50% de réduction) | 2,50 $ | 12,50 $ |
| Mode rapide (aperçu de recherche) | 10,00 $ | 50,00 $ |
| Écriture dans le cache, TTL 5 minutes | 6,25 $ | n/a |
| Écriture dans le cache, TTL 1 heure | 10,00 $ | n/a |
| Accès au cache et rafraîchissements | 0,50 $ | n/a |
Claude Fable 5 facture 10 $ et 50 $. Opus 5 facture 5 $ et 25 $ pour un modèle qu'Anthropic prétend se situer à moins d'un demi-pourcent de Fable 5 en matière de codage agentique. C'est l'argument principal : des performances de pointe à la moitié du prix de pointe.
Quelques leviers moins évidents se trouvent dans ce tableau. Le minimum de mise en cache des invites est passé à 512 jetons, contre 1 024 sur Opus 4.8, de sorte que les invites système qui étaient auparavant trop courtes pour être mises en cache le sont maintenant sans aucune modification de code. Les accès au cache coûtent 0,50 $ par million, un dixième du tarif d'entrée de base. L'API de traitement par lots réduit tout de moitié pour les tâches qui peuvent attendre. Et le surcoût de l'invite système pour l'utilisation d'outils est légèrement moins cher qu'en 4.8, à 286 jetons pour le choix d'outil auto ou none contre 290 sur Opus 4.8 et 675 sur Opus 4.7.
Deux détails de coût piègent les gens. Le mode rapide double le tarif à 10 $ et 50 $ en échange d'une vitesse de sortie environ 2,5 fois supérieure, et il ne fonctionne que sur l'API propriétaire : pas sur Bedrock, pas sur Google Cloud, pas sur Microsoft Foundry, et pas avec l'API par lots. Séparément, le réglage inference_geo: "us" applique un multiplicateur de 1,1x sur chaque catégorie de jetons, de sorte que l'inférence localisée aux États-Unis entraîne une surtaxe de 10 % sur l'entrée, la sortie, les écritures en cache et les accès en cache.
L'analyse complète de la tarification présente des exemples de coût par tâche, et si vous réduisez déjà vos dépenses, les leviers de l'article réduire votre facture API Claude restent applicables. La page de tarification d'Anthropic est le tableau faisant autorité.
Ce qu'Anthropic affirme que les benchmarks montrent
Chaque chiffre ci-dessous est celui d'Anthropic, publié lors du lancement. Au 25 juillet 2026, aucun d'entre eux n'a été reproduit indépendamment. Lisez-les comme des affirmations du fournisseur, et non comme des mesures neutres, et prévoyez d'effectuer vos propres évaluations avant d'engager une charge de travail en production.
| Benchmark | Affirmation d'Anthropic |
|---|---|
| Frontier-Bench v0.1 | Surpasse tous les autres modèles et plus que double le score d'Opus 4.8, à un coût par tâche inférieur |
| ARC-AGI 3 | Environ 3 fois le score du deuxième meilleur modèle |
| OSWorld 2.0 (utilisation de l'ordinateur) | Surpasse Fable 5 pour un tiers du coût |
| CursorBench 3.2 (codage agentique) | À moins de 0,5 % du sommet de Fable 5, pour la moitié du prix |
| Zapier AutomationBench | Taux de réussite environ 1,5 fois supérieur à celui du deuxième meilleur modèle |
| Chimie organique | +10,2 points par rapport à Opus 4.8 |
| Analyse des protéines | +7,7 points par rapport à Opus 4.8 |
La forme des affirmations est cohérente : de grands bonds sur les évaluations agentiques et basées sur des outils, et un argument de coût par tâche attaché à presque chacune d'entre elles. Les résultats de CursorBench et OSWorld sont les deux qui comptent le plus pour la décision d'achat, car ce sont eux qui disent que vous pouvez passer de Fable 5 à Opus 5 sans perdre grand-chose.
Ce sont aussi les deux qui nécessitent le plus votre propre vérification. Un écart d'un demi-pourcent sur une référence de codage choisie par un fournisseur se situe bien dans la fourchette où votre base de code, votre invite et vos définitions d'outils déterminent le résultat. L'analyse approfondie des benchmarks couvre ce que chaque évaluation mesure réellement et ce que vous devez tester vous-même.
Le plafond honnête
Opus 5 n'est pas le sommet de la pile Claude, et Anthropic ne prétend pas qu'il l'est.
Fable 5 conserve la désignation de "modèle le plus performant largement disponible". Et sur deux capacités de recherche spécifiques, l'exploitation de la cybersécurité et la recherche en biologie autonome, Opus 5 est toujours en retard par rapport à Mythos 5. Anthropic le déclare directement dans son propre matériel de lancement, ce qui est à noter compte tenu de la manière dont la couverture médiatique a présenté la sortie.
Le résumé exact est donc plus nuancé que les titres : une capacité de pointe à la moitié du prix de pointe, avec deux capacités spécifiques où un modèle supérieur l'emporte toujours. Pour la plupart des cas de codage agentique et d'automatisation d'entreprise, ce plafond n'est jamais atteint. Pour la recherche en sécurité ou le travail scientifique autonome, il l'est. Le contexte sur la catégorie de recherche se trouve dans l'explication du modèle de classe Mythos et Fable 5 vs Mythos 5.
Deux changements qui cassent le code d'Opus 4.8
Changer l'ID du modèle ne suffit pas. Deux changements vous poseront problème dès votre première requête.
La pensée est activée par défaut. Sur Opus 4.8, une requête sans champ thinking s'exécutait sans pensée. Sur Opus 5, cette même requête exécute la pensée adaptative. Étant donné que max_tokens plafonne toujours les jetons de pensée et le texte de réponse ensemble, une charge de travail qui dimensionnait max_tokens de manière serrée autour de sa sortie attendue peut maintenant être tronquée en plein milieu de la réponse. Aucune erreur n'est signalée. La sortie est simplement coupée, ce qui est le pire type de régression à déboguer.
La désactivation de la pensée est limitée au niveau d'effort high. L'envoi de thinking: {type: "disabled"} avec un effort xhigh ou max renvoie une erreur 400, appliquée par requête. Si vous avez repris une configuration qui désactivait la pensée et augmentait l'effort, chaque appel échouera immédiatement.
Il y a d'autres éléments à migrer : les niveaux d'effort ont été recalibrés, de sorte qu'Anthropic recommande explicitement d'effectuer une nouvelle analyse d'effort au lieu de reprendre vos anciens paramètres Opus 4.8, l'en-tête bêta de la fenêtre de contexte a disparu, les messages système en cours de conversation sont désormais acceptés là où 4.8 les rejetait avec une 400, et le Niveau de Priorité a disparu. Le guide de migration d'Opus 4.8 vers Opus 5 contient les extraits avant et après pour chacun d'eux, et le guide de migration d'Anthropic est la référence principale. Si vous utilisez toujours la génération précédente, la présentation de l'API Opus 4.8 montre ce que vous migrez.
Le paramètre d'effort, pas un interrupteur
La plupart des articles de lancement décrivaient Opus 5 comme permettant aux utilisateurs de basculer entre le coût et la capacité. Ce cadre fait référence à un véritable paramètre d'API : output_config.effort.
L'effort a cinq niveaux, de low à max, et il est par défaut à high. Il contrôle la quantité de réflexion du modèle avant de répondre, ce qui à son tour contrôle ce que vous dépensez. Les interfaces utilisateurs l'exposent comme un sélecteur d'effort plutôt que comme un paramètre brut, mais c'est le même contrôle sous-jacent.
Deux choses ont changé dans cette génération. Les niveaux ont été recalibrés, de sorte qu'Anthropic recommande explicitement d'effectuer une nouvelle analyse d'effort au lieu de reprendre vos paramètres Opus 4.8. Et les niveaux low et medium sont nettement plus performants sur Opus 5 que sur tout modèle Opus précédent, ce qui les rend utilisables pour un travail réel pour la première fois plutôt que d'être les paramètres que vous évitiez. Pour le codage et les boucles agentiques, xhigh reste le point de départ recommandé.
Le guide du paramètre d'effort couvre les cinq niveaux, comment effectuer une analyse par rapport à vos propres évaluations, et l'interaction avec max_tokens.
Comment Opus 5 se comporte différemment
Le guide d'ingénierie des invites d'Anthropic pour Opus 5 documente les changements de comportement qui modifieront vos résultats même si votre code est identique au bit près.
- Il vérifie son propre travail sans y être invité. Les instructions héritées de "double vérification de la réponse" entraînent désormais une sur-vérification et brûlent des jetons inutilement. Le conseil d'Anthropic est de les supprimer.
- Les réponses par défaut et les livrables écrits sont plus longs que ceux d'Opus 4.8. Réduire l'effort diminue la pensée, pas la longueur visible de la sortie, alors demandez explicitement de la concision si vous en avez besoin.
- Il délègue plus facilement à des sous-agents. Limitez ou délimitez la délégation sur les charges de travail sensibles aux coûts.
- Il étend la portée des tâches et narre davantage ses corrections. Limitez les tâches spécifiques dans l'invite.
Il existe un mode de défaillance à connaître. Lorsque la pensée est désactivée, deux artefacts apparaissent occasionnellement : des appels d'outils écrits en texte brut qui ne s'exécutent jamais, et des balises XML internes apparaissant dans la sortie visible. Dans une boucle agentique, le texte divulgué peut corrompre les tours suivants. L'atténuation d'Anthropic est de garder la pensée activée et de contrôler le coût avec un niveau d'effort plus bas à la place. L'analyse approfondie de l'ingénierie des invites contient des extraits à copier-coller pour chaque changement, et le guide Claude Code les applique aux flux de travail d'éditeur.
Où vous pouvez l'exécuter
| Plateforme | Statut |
|---|---|
| API Claude | Disponible, ID du modèle claude-opus-5 |
| claude.ai | Disponible ; par défaut pour Max, modèle supérieur pour Pro |
| Claude Code | Disponible |
| Claude Cowork | Disponible |
| Amazon Bedrock | Disponible sous anthropic.claude-opus-5 |
| Plateforme Claude sur AWS | Disponible, ID propriétaire |
| Google Cloud | Disponible sous claude-opus-5 |
| Microsoft Foundry | Disponible |
| GitHub Copilot | Disponible |
Le mode rapide est l'exception à cette matrice. Il ne fonctionne que sur l'API propriétaire, de sorte qu'un déploiement Bedrock ou Google Cloud ne peut pas l'atteindre.
Tester les requêtes Opus 5 dans Apidog
Appeler Opus 5 signifie atteindre un point de terminaison HTTP avec des en-têtes d'authentification, un corps JSON, des réponses en continu et des erreurs que vous devez reproduire. Apidog s'en charge : envoyez la requête, enregistrez-la dans une collection, gardez votre clé API dans une variable d'environnement plutôt que collée dans un corps, et lisez la réponse champ par champ.

Une configuration pratique pour ce modèle :
- Stockez
ANTHROPIC_API_KEYcomme variable d'environnement afin que la clé n'apparaisse jamais dans une collection partagée. - Enregistrez une requête Messages de référence, puis dupliquez-la par niveau d'effort afin de pouvoir comparer
low,highetxhighcôte à côte sur la même invite. - Surveillez le flux SSE directement lorsque vous activez le streaming, afin de voir où une réponse tronquée s'est réellement arrêtée.
- Lisez le bloc
usagesur chaque réponse pour confirmer que les accès au cache se produisent et pour voir combien de jetons de pensée la requête a consommés.
Voici la requête de référence :
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
]
}'
Cette requête exécute la pensée adaptative, car la pensée est activée par défaut et aucun champ thinking n'est présent. Donnez à max_tokens suffisamment d'espace : 1 024 était suffisant sur Opus 4.8 et sera tronqué ici. Pour suivre le guide, Téléchargez Apidog et importez la requête. Le guide API étape par étape couvre le streaming, l'utilisation d'outils et la lecture de usage en détail.
Qui devrait utiliser Claude Opus 5
Optez pour Opus 5 lorsque :
- Vous développez des agents ou des flux de travail fortement basés sur des outils. C'est la charge de travail pour laquelle Anthropic a optimisé le modèle et où ses revendications de référence sont les plus solides.
- Vous utilisez Fable 5 et la facture est salée. La moitié du prix pour un écart annoncé d'un demi-pourcent sur le codage agentique mérite une véritable évaluation. La comparaison Opus 5 vs Fable 5 encadre cette décision.
- Vous utilisez Opus 4.8 aujourd'hui. Même prix, chiffres annoncés meilleurs, date limite de connaissance plus récente. Le seul coût est le travail de migration.
- Vous avez besoin de connaissances récentes. Mai 2026 bat tous les autres modèles Claude actuels d'environ quatre mois.
Restez là où vous êtes lorsque :
- Le Niveau de Priorité est essentiel. Opus 4.8 le conserve et Opus 5 non, alors vérifiez la tarification et les niveaux d'Opus 4.8 avant de passer à l'autre.
- Votre charge de travail est peu coûteuse et à volume élevé. Sonnet 5 coûte moins cher et peut être suffisant. La comparaison Opus 5 vs Sonnet 5 couvre les situations où le surcoût de 2,5x est justifié.
- Vous faites de l'exploitation de cybersécurité ou de la recherche en biologie autonome. Mythos 5 garde la tête là.
FAQ
Quel est l'ID du modèle pour Claude Opus 5 ? C'est la chaîne exacte claude-opus-5, sans suffixe de date. Sur Amazon Bedrock, utilisez anthropic.claude-opus-5 ; Google Cloud et la plateforme Claude sur AWS utilisent claude-opus-5.
Combien coûte Claude Opus 5 ? 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, identique à Opus 4.8 et la moitié des 10 $ et 50 $ de Fable 5. L'API par lots le réduit encore de moitié à 2,50 $ et 12,50 $. Le mode rapide le double à 10 $ et 50 $.
Claude Opus 5 est-il meilleur que Fable 5 ? Selon les chiffres d'Anthropic, il est proche, pas en avance. Anthropic rapporte qu'Opus 5 se situe à moins de 0,5 % de Fable 5 sur CursorBench 3.2 et en avance sur OSWorld 2.0 pour un tiers du coût, mais Fable 5 conserve la désignation de "modèle le plus performant largement disponible". Ce sont des résultats fournis par le fournisseur sans reproduction indépendante pour le moment.
Quelle est la fenêtre de contexte sur Claude Opus 5 ? 1 000 000 de jetons, par défaut et maximum, sans en-tête bêta et sans prime de prix pour contexte long. La sortie maximale est de 128 000 jetons sur l'API Messages, ou 300 000 sur l'API de traitement par lots avec l'en-tête bêta output-300k-2026-03-24.
Dois-je modifier mon code pour passer d'Opus 4.8 ? Au-delà de l'ID du modèle, oui. La pensée est désormais activée par défaut, alors réexaminez max_tokens ou risquez une troncation silencieuse. Et thinking: {type: "disabled"} combiné avec un effort xhigh ou max renvoie une erreur 400. Relancez également votre analyse d'effort, car les niveaux ont été recalibrés.
Quelle est la date limite de connaissance de Claude Opus 5 ? Mai 2026 pour les connaissances fiables et les données d'entraînement, la plus récente de tous les modèles Claude actuels.
