Qu'est-ce que Claude Opus 5 ? Spécifications, Benchmarks et Prix

Claude Opus 5 expliqué : le lancement en juillet 2026, l'identifiant du modèle, le contexte d'un million, la date de coupure de mai 2026, la tarification à 5 $/25 $ par rapport à Fable 5, les revendications de benchmark d'Anthropic, et le plafond réel.

Ashley Innocent

Ashley Innocent

25 July 2026

Qu'est-ce que Claude Opus 5 ? Spécifications, Benchmarks et Prix

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Claude Opus 5 est le tout dernier modèle de la série Opus d'Anthropic, lancé le 24 juillet 2026. Anthropic le positionne pour le codage agentique complexe et le travail en entreprise, et la documentation le nomme désormais le point de départ par défaut : si vous n'êtes pas sûr du modèle à utiliser, commencez par Claude Opus 5. Le chiffre clé est le prix. Opus 5 coûte 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, soit le même tarif qu'Opus 4.8 et la moitié de ce que Fable 5 facture.

Ce guide couvre les spécifications, le rapport prix-performance, les références de lancement d'Anthropic et leur fiabilité, les deux changements d'API qui cassent le code existant d'Opus 4.8, où vous pouvez exécuter le modèle, et la limite qu'Anthropic annonce clairement. Si vous appelez le modèle via HTTP, vous pouvez envoyer et inspecter ces requêtes dans Apidog au fur et à mesure.

button

Claude Opus 5 en un coup d'œil

Spécification Valeur
ID de modèle API claude-opus-5 (sans suffixe de date)
Lancé le 24 juillet 2026
Fenêtre de contexte 1 000 000 de jetons, par défaut et maximum
Sortie maximale 128 000 jetons sur l'API Messages ; 300 000 sur l'API de traitement par lots avec l'en-tête bêta output-300k-2026-03-24
Tarification de base 5 $ par million de jetons d'entrée, 25 $ par million de jetons de sortie
Date limite de connaissance Mai 2026
Pensée adaptative Activé par défaut
Niveaux d'effort low, medium, high, xhigh, max ; par défaut à high
Niveau de priorité Non pris en charge
Disponibilité API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plateforme Claude sur AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Trois de ces lignes méritent un deuxième examen.

La fenêtre de contexte de 1M est à la fois par défaut et maximale, et elle ne nécessite pas d'en-tête bêta. Il n'y a pas non plus de prime de contexte long, donc une invite de 900 000 jetons est facturée au même tarif par jeton qu'une invite de 900 jetons.

La date limite de connaissance de mai 2026 est la plus récente de tous les modèles Claude actuels. Fable 5 et Sonnet 5 sont tous deux à janvier 2026, donc Opus 5 connaît environ quatre mois supplémentaires de bibliothèques, de versions et de changements d'API sans que vous ayez à les coller.

Le Niveau de Priorité est la seule fonctionnalité qui a régressé. Opus 4.8 le prend en charge ; Opus 5 non. Si la planification de la capacité de votre entreprise dépend du Niveau de Priorité, c'est une véritable contrainte et elle est couverte dans le guide de migration.

Pour le tableau complet des modèles et chaque champ textuellement, l'aperçu des modèles d'Anthropic est la source officielle.

Ce qu'est Claude Opus 5

Opus 5 est le successeur de Claude Opus 4.8. L'ID du modèle API est la chaîne exacte claude-opus-5. Sur Amazon Bedrock, l'ID est anthropic.claude-opus-5, et sur Google Cloud, c'est à nouveau claude-opus-5. La plateforme Claude sur AWS utilise l'ID propriétaire.

La série Opus a toujours été la gamme puissante d'Anthropic, se situant au-dessus de Sonnet et en dessous des modèles de pointe en recherche Fable et Mythos. Ce qui a changé avec Opus 5, c'est que cette série a cessé d'être l'option coûteuse vers laquelle on escalade. La documentation d'Anthropic vous dit maintenant de commencer ici, ce qui est une position différente de la génération 4.x, où Sonnet était le modèle par défaut et Opus était la mise à niveau.

Le modèle devient également la valeur par défaut pour les abonnés Max et le modèle le plus performant disponible sur Pro, ce qui est la première fois qu'un modèle de classe Opus est le plafond pour un plan consommateur à prix moyen. L'article sur les chemins gratuits et les moins chers explique ce que cela vous apporte réellement.

Le rapport prix-performance

C'est la partie sur laquelle chaque article de lancement a mis l'accent, et elle se confirme lorsque vous consultez la page de tarification.

Tarif Entrée (par M jetons) Sortie (par M jetons)
Standard 5,00 $ 25,00 $
API par lots (50% de réduction) 2,50 $ 12,50 $
Mode rapide (aperçu de recherche) 10,00 $ 50,00 $
Écriture dans le cache, TTL 5 minutes 6,25 $ n/a
Écriture dans le cache, TTL 1 heure 10,00 $ n/a
Accès au cache et rafraîchissements 0,50 $ n/a

Claude Fable 5 facture 10 $ et 50 $. Opus 5 facture 5 $ et 25 $ pour un modèle qu'Anthropic prétend se situer à moins d'un demi-pourcent de Fable 5 en matière de codage agentique. C'est l'argument principal : des performances de pointe à la moitié du prix de pointe.

Quelques leviers moins évidents se trouvent dans ce tableau. Le minimum de mise en cache des invites est passé à 512 jetons, contre 1 024 sur Opus 4.8, de sorte que les invites système qui étaient auparavant trop courtes pour être mises en cache le sont maintenant sans aucune modification de code. Les accès au cache coûtent 0,50 $ par million, un dixième du tarif d'entrée de base. L'API de traitement par lots réduit tout de moitié pour les tâches qui peuvent attendre. Et le surcoût de l'invite système pour l'utilisation d'outils est légèrement moins cher qu'en 4.8, à 286 jetons pour le choix d'outil auto ou none contre 290 sur Opus 4.8 et 675 sur Opus 4.7.

Deux détails de coût piègent les gens. Le mode rapide double le tarif à 10 $ et 50 $ en échange d'une vitesse de sortie environ 2,5 fois supérieure, et il ne fonctionne que sur l'API propriétaire : pas sur Bedrock, pas sur Google Cloud, pas sur Microsoft Foundry, et pas avec l'API par lots. Séparément, le réglage inference_geo: "us" applique un multiplicateur de 1,1x sur chaque catégorie de jetons, de sorte que l'inférence localisée aux États-Unis entraîne une surtaxe de 10 % sur l'entrée, la sortie, les écritures en cache et les accès en cache.

L'analyse complète de la tarification présente des exemples de coût par tâche, et si vous réduisez déjà vos dépenses, les leviers de l'article réduire votre facture API Claude restent applicables. La page de tarification d'Anthropic est le tableau faisant autorité.

Ce qu'Anthropic affirme que les benchmarks montrent

Chaque chiffre ci-dessous est celui d'Anthropic, publié lors du lancement. Au 25 juillet 2026, aucun d'entre eux n'a été reproduit indépendamment. Lisez-les comme des affirmations du fournisseur, et non comme des mesures neutres, et prévoyez d'effectuer vos propres évaluations avant d'engager une charge de travail en production.

Benchmark Affirmation d'Anthropic
Frontier-Bench v0.1 Surpasse tous les autres modèles et plus que double le score d'Opus 4.8, à un coût par tâche inférieur
ARC-AGI 3 Environ 3 fois le score du deuxième meilleur modèle
OSWorld 2.0 (utilisation de l'ordinateur) Surpasse Fable 5 pour un tiers du coût
CursorBench 3.2 (codage agentique) À moins de 0,5 % du sommet de Fable 5, pour la moitié du prix
Zapier AutomationBench Taux de réussite environ 1,5 fois supérieur à celui du deuxième meilleur modèle
Chimie organique +10,2 points par rapport à Opus 4.8
Analyse des protéines +7,7 points par rapport à Opus 4.8

La forme des affirmations est cohérente : de grands bonds sur les évaluations agentiques et basées sur des outils, et un argument de coût par tâche attaché à presque chacune d'entre elles. Les résultats de CursorBench et OSWorld sont les deux qui comptent le plus pour la décision d'achat, car ce sont eux qui disent que vous pouvez passer de Fable 5 à Opus 5 sans perdre grand-chose.

Ce sont aussi les deux qui nécessitent le plus votre propre vérification. Un écart d'un demi-pourcent sur une référence de codage choisie par un fournisseur se situe bien dans la fourchette où votre base de code, votre invite et vos définitions d'outils déterminent le résultat. L'analyse approfondie des benchmarks couvre ce que chaque évaluation mesure réellement et ce que vous devez tester vous-même.

Le plafond honnête

Opus 5 n'est pas le sommet de la pile Claude, et Anthropic ne prétend pas qu'il l'est.

Fable 5 conserve la désignation de "modèle le plus performant largement disponible". Et sur deux capacités de recherche spécifiques, l'exploitation de la cybersécurité et la recherche en biologie autonome, Opus 5 est toujours en retard par rapport à Mythos 5. Anthropic le déclare directement dans son propre matériel de lancement, ce qui est à noter compte tenu de la manière dont la couverture médiatique a présenté la sortie.

Le résumé exact est donc plus nuancé que les titres : une capacité de pointe à la moitié du prix de pointe, avec deux capacités spécifiques où un modèle supérieur l'emporte toujours. Pour la plupart des cas de codage agentique et d'automatisation d'entreprise, ce plafond n'est jamais atteint. Pour la recherche en sécurité ou le travail scientifique autonome, il l'est. Le contexte sur la catégorie de recherche se trouve dans l'explication du modèle de classe Mythos et Fable 5 vs Mythos 5.

Deux changements qui cassent le code d'Opus 4.8

Changer l'ID du modèle ne suffit pas. Deux changements vous poseront problème dès votre première requête.

La pensée est activée par défaut. Sur Opus 4.8, une requête sans champ thinking s'exécutait sans pensée. Sur Opus 5, cette même requête exécute la pensée adaptative. Étant donné que max_tokens plafonne toujours les jetons de pensée et le texte de réponse ensemble, une charge de travail qui dimensionnait max_tokens de manière serrée autour de sa sortie attendue peut maintenant être tronquée en plein milieu de la réponse. Aucune erreur n'est signalée. La sortie est simplement coupée, ce qui est le pire type de régression à déboguer.

La désactivation de la pensée est limitée au niveau d'effort high. L'envoi de thinking: {type: "disabled"} avec un effort xhigh ou max renvoie une erreur 400, appliquée par requête. Si vous avez repris une configuration qui désactivait la pensée et augmentait l'effort, chaque appel échouera immédiatement.

Il y a d'autres éléments à migrer : les niveaux d'effort ont été recalibrés, de sorte qu'Anthropic recommande explicitement d'effectuer une nouvelle analyse d'effort au lieu de reprendre vos anciens paramètres Opus 4.8, l'en-tête bêta de la fenêtre de contexte a disparu, les messages système en cours de conversation sont désormais acceptés là où 4.8 les rejetait avec une 400, et le Niveau de Priorité a disparu. Le guide de migration d'Opus 4.8 vers Opus 5 contient les extraits avant et après pour chacun d'eux, et le guide de migration d'Anthropic est la référence principale. Si vous utilisez toujours la génération précédente, la présentation de l'API Opus 4.8 montre ce que vous migrez.

Le paramètre d'effort, pas un interrupteur

La plupart des articles de lancement décrivaient Opus 5 comme permettant aux utilisateurs de basculer entre le coût et la capacité. Ce cadre fait référence à un véritable paramètre d'API : output_config.effort.

L'effort a cinq niveaux, de low à max, et il est par défaut à high. Il contrôle la quantité de réflexion du modèle avant de répondre, ce qui à son tour contrôle ce que vous dépensez. Les interfaces utilisateurs l'exposent comme un sélecteur d'effort plutôt que comme un paramètre brut, mais c'est le même contrôle sous-jacent.

Deux choses ont changé dans cette génération. Les niveaux ont été recalibrés, de sorte qu'Anthropic recommande explicitement d'effectuer une nouvelle analyse d'effort au lieu de reprendre vos paramètres Opus 4.8. Et les niveaux low et medium sont nettement plus performants sur Opus 5 que sur tout modèle Opus précédent, ce qui les rend utilisables pour un travail réel pour la première fois plutôt que d'être les paramètres que vous évitiez. Pour le codage et les boucles agentiques, xhigh reste le point de départ recommandé.

Le guide du paramètre d'effort couvre les cinq niveaux, comment effectuer une analyse par rapport à vos propres évaluations, et l'interaction avec max_tokens.

Comment Opus 5 se comporte différemment

Le guide d'ingénierie des invites d'Anthropic pour Opus 5 documente les changements de comportement qui modifieront vos résultats même si votre code est identique au bit près.

Il existe un mode de défaillance à connaître. Lorsque la pensée est désactivée, deux artefacts apparaissent occasionnellement : des appels d'outils écrits en texte brut qui ne s'exécutent jamais, et des balises XML internes apparaissant dans la sortie visible. Dans une boucle agentique, le texte divulgué peut corrompre les tours suivants. L'atténuation d'Anthropic est de garder la pensée activée et de contrôler le coût avec un niveau d'effort plus bas à la place. L'analyse approfondie de l'ingénierie des invites contient des extraits à copier-coller pour chaque changement, et le guide Claude Code les applique aux flux de travail d'éditeur.

Où vous pouvez l'exécuter

Plateforme Statut
API Claude Disponible, ID du modèle claude-opus-5
claude.ai Disponible ; par défaut pour Max, modèle supérieur pour Pro
Claude Code Disponible
Claude Cowork Disponible
Amazon Bedrock Disponible sous anthropic.claude-opus-5
Plateforme Claude sur AWS Disponible, ID propriétaire
Google Cloud Disponible sous claude-opus-5
Microsoft Foundry Disponible
GitHub Copilot Disponible

Le mode rapide est l'exception à cette matrice. Il ne fonctionne que sur l'API propriétaire, de sorte qu'un déploiement Bedrock ou Google Cloud ne peut pas l'atteindre.

Tester les requêtes Opus 5 dans Apidog

Appeler Opus 5 signifie atteindre un point de terminaison HTTP avec des en-têtes d'authentification, un corps JSON, des réponses en continu et des erreurs que vous devez reproduire. Apidog s'en charge : envoyez la requête, enregistrez-la dans une collection, gardez votre clé API dans une variable d'environnement plutôt que collée dans un corps, et lisez la réponse champ par champ.

Une configuration pratique pour ce modèle :

  1. Stockez ANTHROPIC_API_KEY comme variable d'environnement afin que la clé n'apparaisse jamais dans une collection partagée.
  2. Enregistrez une requête Messages de référence, puis dupliquez-la par niveau d'effort afin de pouvoir comparer low, high et xhigh côte à côte sur la même invite.
  3. Surveillez le flux SSE directement lorsque vous activez le streaming, afin de voir où une réponse tronquée s'est réellement arrêtée.
  4. Lisez le bloc usage sur chaque réponse pour confirmer que les accès au cache se produisent et pour voir combien de jetons de pensée la requête a consommés.

Voici la requête de référence :

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
    ]
  }'

Cette requête exécute la pensée adaptative, car la pensée est activée par défaut et aucun champ thinking n'est présent. Donnez à max_tokens suffisamment d'espace : 1 024 était suffisant sur Opus 4.8 et sera tronqué ici. Pour suivre le guide, Téléchargez Apidog et importez la requête. Le guide API étape par étape couvre le streaming, l'utilisation d'outils et la lecture de usage en détail.

Qui devrait utiliser Claude Opus 5

Optez pour Opus 5 lorsque :

Restez là où vous êtes lorsque :

FAQ

Quel est l'ID du modèle pour Claude Opus 5 ? C'est la chaîne exacte claude-opus-5, sans suffixe de date. Sur Amazon Bedrock, utilisez anthropic.claude-opus-5 ; Google Cloud et la plateforme Claude sur AWS utilisent claude-opus-5.

Combien coûte Claude Opus 5 ? 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, identique à Opus 4.8 et la moitié des 10 $ et 50 $ de Fable 5. L'API par lots le réduit encore de moitié à 2,50 $ et 12,50 $. Le mode rapide le double à 10 $ et 50 $.

Claude Opus 5 est-il meilleur que Fable 5 ? Selon les chiffres d'Anthropic, il est proche, pas en avance. Anthropic rapporte qu'Opus 5 se situe à moins de 0,5 % de Fable 5 sur CursorBench 3.2 et en avance sur OSWorld 2.0 pour un tiers du coût, mais Fable 5 conserve la désignation de "modèle le plus performant largement disponible". Ce sont des résultats fournis par le fournisseur sans reproduction indépendante pour le moment.

Quelle est la fenêtre de contexte sur Claude Opus 5 ? 1 000 000 de jetons, par défaut et maximum, sans en-tête bêta et sans prime de prix pour contexte long. La sortie maximale est de 128 000 jetons sur l'API Messages, ou 300 000 sur l'API de traitement par lots avec l'en-tête bêta output-300k-2026-03-24.

Dois-je modifier mon code pour passer d'Opus 4.8 ? Au-delà de l'ID du modèle, oui. La pensée est désormais activée par défaut, alors réexaminez max_tokens ou risquez une troncation silencieuse. Et thinking: {type: "disabled"} combiné avec un effort xhigh ou max renvoie une erreur 400. Relancez également votre analyse d'effort, car les niveaux ont été recalibrés.

Quelle est la date limite de connaissance de Claude Opus 5 ? Mai 2026 pour les connaissances fiables et les données d'entraînement, la plus récente de tous les modèles Claude actuels.

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API