Claude Opus 5とは?スペック、ベンチマーク、価格を徹底解説

Claude Opus 5の解説:2026年7月リリース、モデルID、100万トークンのコンテキスト、2026年5月までの学習データ、Fable 5に対する5ドル/25ドルの料金設定、Anthropicが主張するベンチマーク結果、そして正直な限界。

Ashley Innocent

Ashley Innocent

25 7月 2026

Claude Opus 5とは?スペック、ベンチマーク、価格を徹底解説

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Claude Opus 5は、Anthropicが2026年7月24日にリリースした、最新のOpus層モデルです。Anthropicは、これを複雑なエージェント型コーディングやエンタープライズ向け作業に位置づけており、ドキュメントではデフォルトの開始点としています。どのモデルを使用すべきか迷った場合は、まずClaude Opus 5から始めることを推奨しています。目玉となる数字は価格です。Opus 5は、入力トークン100万あたり5ドル、出力トークン100万あたり25ドルで、これはOpus 4.8と同額であり、Fable 5が請求する料金の半分です。

このガイドでは、仕様、価格性能に関する話、Anthropicの発表ベンチマークとその信頼性、既存のOpus 4.8コードを破壊する2つのAPI変更点、モデルを実行できる場所、そしてAnthropicが率直に明かしている限界について説明します。HTTP経由でモデルを呼び出す場合、これらのリクエストはApidogで送信および検査できます。

button

Claude Opus 5の概要

仕様
APIモデルID claude-opus-5 (日付サフィックスなし)
リリース日 2026年7月24日
コンテキストウィンドウ 1,000,000トークン、デフォルトおよび最大
最大出力 Messages APIで128,000トークン、Batch APIではoutput-300k-2026-03-24ベータヘッダー使用時に300,000トークン
基本料金 入力トークン100万あたり5ドル、出力トークン100万あたり25ドル
知識のカットオフ 2026年5月
適応思考 デフォルトでオン
エフォートレベル low, medium, high, xhigh, max; デフォルトはhigh
優先ティア サポートされていません
利用可能性 Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform (AWS上), Google Cloud, Microsoft Foundry, GitHub Copilot

これらの行のうち3つは、改めて検討する価値があります。

100万トークンのコンテキストウィンドウは、デフォルトであり最大値でもあり、ベータヘッダーは不要です。また、長文コンテキストのプレミアム料金もなく、90万トークンのプロンプトでも900トークンのプロンプトと同じトークン単価で課金されます。

2026年5月の知識カットオフは、現在のどのClaudeモデルよりも最新です。Fable 5とSonnet 5はともに2026年1月であるため、Opus 5は、あなたが貼り付けることなく、約4ヶ月分のライブラリ、リリース、API変更に関する知識を持っています。

優先ティアは、後退した唯一の機能です。Opus 4.8はこれをサポートしていますが、Opus 5はサポートしていません。エンタープライズのキャパシティプランニングが優先ティアに依存している場合、これは実際の制約となり、移行ガイドで詳しく説明されています。

完全なモデルテーブルとすべてのフィールドの詳細は、Anthropicのモデル概要を参照してください。

Claude Opus 5とは

Opus 5は、Claude Opus 4.8の後継モデルです。APIモデルIDは、正確にclaude-opus-5という文字列です。Amazon BedrockではIDがanthropic.claude-opus-5となり、Google Cloudでは再びclaude-opus-5となります。AWS上のClaude Platformは、ファーストパーティIDを使用します。

Opus層は常にAnthropicの主力ラインであり、Sonnetの上に位置し、FableおよびMythosのフロンティア研究モデルの下に位置していました。Opus 5で変わったのは、この層がより上位にエスカレートするための高価な選択肢ではなくなったことです。Anthropicのドキュメントでは、今やここから始めるように指示しており、これはSonnetがデフォルトでOpusがアップグレードだった4.x世代とは異なる姿勢です。

このモデルは、Maxサブスクライバーのデフォルトとなり、Proで利用可能な最高性能のモデルでもあります。Opusクラスのモデルが中価格帯の消費者向けプランの最上位となるのは、これが初めてです。無料および最も安価な有料プランの記事では、それが実際に何をもたらすかを詳しく説明しています。

価格性能に関する話

これは、発表日のあらゆる記事が最初に触れた部分であり、料金ページを見ればその通りだと分かります。

料金 入力 (100万トークンあたり) 出力 (100万トークンあたり)
標準 $5.00 $25.00
Batch API (50%割引) $2.50 $12.50
高速モード (研究プレビュー) $10.00 $50.00
キャッシュ書き込み, 5分TTL $6.25 N/A
キャッシュ書き込み, 1時間TTL $10.00 N/A
キャッシュヒットとリフレッシュ $0.50 N/A

Claude Fable 5は10ドルと50ドルを請求します。Opus 5は、Anthropicがエージェント型コーディングにおいてFable 5の0.5%以内に入ると主張するモデルに対し、5ドルと25ドルを請求します。これがAnthropicの主張のすべてです。フロンティアクラスの出力を半分のフロンティア価格で提供します。

その表には、あまり目立たないいくつかのレバーが存在します。プロンプトのキャッシュ最小値がOpus 4.8の1,024トークンから512トークンに下がったため、以前は短すぎてキャッシュできなかったシステムプロンプトも、コード変更なしでキャッシュできるようになりました。キャッシュヒットは100万トークンあたり0.50ドルで、基本入力料金の10分の1です。Batch APIは、待機可能な作業の場合、すべての料金を半分にします。また、ツール使用時のシステムプロンプトのオーバーヘッドは、Opus 4.8の290トークン、Opus 4.7の675トークンと比較して、autoまたはnoneのツール選択で286トークンと、4.8よりもわずかに安価です。

費用に関する2つの詳細が人々を惑わせます。高速モードは、約2.5倍の出力速度と引き換えに料金を10ドルと50ドルに倍増させますが、これはファーストパーティAPIでのみ動作し、Bedrock、Google Cloud、Microsoft Foundry、Batch APIでは利用できません。別に、inference_geo: "us"を設定すると、すべてのトークンカテゴリに1.1倍の乗数が適用されるため、米国に固定された推論は、入力、出力、キャッシュ書き込み、キャッシュヒットすべてに10%の追加料金がかかります。

完全な料金内訳ではタスクごとのコスト例を詳しく説明しており、すでに支出を削減している場合でも、Claude APIの請求額を削減するで紹介されている手段が引き続き適用されます。Anthropicの料金ページが公式の表です。

Anthropicが発表したベンチマーク

以下の数値はすべてAnthropicが発表時に公開したものです。2026年7月25日現在、これらは独立して再現されていません。中立的な測定値ではなく、ベンダーの主張として読み、本番環境のワークロードをコミットする前に独自の評価を実行する計画を立ててください。

ベンチマーク Anthropicの主張
Frontier-Bench v0.1 他のすべてのモデルを凌駕し、Opus 4.8のスコアを2倍以上に向上させ、タスクごとのコストも削減
ARC-AGI 3 次点のモデルのスコアを約3倍上回る
OSWorld 2.0 (コンピューター使用) Fable 5を凌駕し、コストは3分の1
CursorBench 3.2 (エージェント型コーディング) Fable 5のピークから0.5%以内、価格は半分
Zapier AutomationBench 合格率が次点のモデルの約1.5倍
有機化学 Opus 4.8より+10.2ポイント
タンパク質分析 Opus 4.8より+7.7ポイント

これらの主張の傾向は一貫しています。エージェント型およびツール駆動型評価での大幅な飛躍と、ほぼすべての主張に付随するタスクごとのコストに関する議論です。CursorBenchとOSWorldの結果は、Fable 5からOpus 5に移行しても大きな損失がないことを示唆しているため、購入決定において最も重要です。

また、これら2つは、特にあなた自身による検証が必要です。ベンダーが選択したコーディングベンチマークでの0.5%の差は、あなたのコードベース、プロンプト、ツール定義が結果を左右する範囲内に十分に収まります。ベンチマーク詳細解説では、各評価が実際に何を測定しているか、そして何を自分でテストすべきかを説明しています。

正直な限界

Opus 5はClaudeスタックの最上位ではなく、Anthropicもそう主張していません。

Fable 5は「最も高性能な広くリリースされたモデル」という称号を維持しています。また、サイバーセキュリティの悪用と自律的な生物学研究という2つの特定の研究能力においては、Opus 5は依然としてMythos 5に遅れをとっています。Anthropicは、主流の報道がこのリリースをどのように捉えたかを考えると、この点を自社の発表資料で直接述べていることは注目に値します。

したがって、正確な要約はヘッドラインよりも限定的です。フロンティアクラスの能力を半分のフロンティア価格で提供するものの、特定の2つの能力ではそれより上位のモデルがまだ優位に立っています。ほとんどのエージェント型コーディングやエンタープライズ自動化においては、その限界に達することはありません。しかし、セキュリティ研究や自律的な科学研究においては、その限界が関係してきます。研究ティアに関する背景は、Mythosクラスモデルの解説Fable 5 vs Mythos 5で説明されています。

Opus 4.8コードを破壊する2つの変更点

モデルIDを入れ替えるだけでは不十分です。最初のリクエストで2つの変更点が問題になります。

思考がデフォルトでオンになりました。 Opus 4.8では、thinkingフィールドがないリクエストは思考なしで実行されました。Opus 5では、同じリクエストが適応思考を実行します。max_tokensは引き続き思考トークンと応答テキストを合わせて上限を設定するため、期待される出力に合わせてmax_tokensを厳密に設定していたワークロードでは、応答の途中で切り詰められる可能性があります。エラーは発生しません。出力が途中で切れてしまうだけであり、これはデバッグする上で最悪の種類の回帰です。

思考の無効化はhighエフォートで上限が設けられています。 thinking: {type: "disabled"}xhighまたはmaxエフォートと共に送信すると、リクエストごとに400エラーが返されます。思考をオフにしてエフォートを上げていた設定を引き継いだ場合、すべての呼び出しがすぐに失敗します。

移行対象は他にもあります。エフォートレベルが再調整されたため、古いスイープ結果は引き継がれなくなり、コンテキストウィンドウのベータヘッダーは廃止され、会話途中のシステムメッセージが4.8で400エラーで拒否されていたのが受け入れられるようになり、優先ティアはなくなりました。Opus 4.8からOpus 5への移行ガイドには、それぞれの変更前後のスニペットが含まれており、Anthropicの移行ガイドが主要な参考資料です。まだ以前の世代を使用している場合、Opus 4.8 APIウォークスルーは、あなたが何から移行するのかを示しています。

エフォートパラメータ、トグルではない

ほとんどの発表記事では、Opus 5はユーザーがコストと能力を切り替えられるようにすると説明されていました。この表現は、実際のAPIパラメータであるoutput_config.effortを指しています。

エフォートにはlowからmaxまでの5つのレベルがあり、デフォルトはhighです。これは、モデルが回答する前にどれだけ思考するかを制御し、それが結果としてあなたの支出を制御します。消費者向けインターフェースでは、生パラメータではなくエフォートセレクターとして公開されていますが、その下にある制御は同じです。

この世代では2つの点が変更されました。レベルが再調整されたため、AnthropicはOpus 4.8の設定を引き継ぐのではなく、新しいエフォートスイープを実行することを明示的に推奨しています。また、lowmediumは、以前のどのOpusモデルよりもOpus 5で大幅に強力になり、これまで避けていた設定ではなく、初めて実際の作業で利用可能になりました。コーディングおよびエージェントループでは、xhighが引き続き推奨される開始点です。

エフォートパラメータガイドでは、5つのレベルすべて、独自の評価に対するスイープの実行方法、およびmax_tokensとの相互作用について説明しています。

Opus 5の異なる挙動

AnthropicのOpus 5向けプロンプトガイドは、コードがバイト単位で同じであっても結果が変わる行動変化を文書化しています。

知っておくべき失敗モードが一つあります。思考が無効化されている場合、時折2つのアーティファクトが現れます。実行されないプレーンテキストとして記述されたツール呼び出しと、目に見える出力に内部XMLタグが現れることです。エージェントループでは、漏洩したテキストが後続のターンを汚染する可能性があります。Anthropic自身の緩和策は、思考を有効にしたまま、より低いエフォートレベルでコストを制御することです。プロンプトの詳細解説には各変更点ごとのコピー&ペースト可能なスニペットがあり、Claude Codeガイドはそれらをエディタのワークフローに適用します。

実行可能な場所

利用場所 ステータス
Claude API 利用可能、モデルID claude-opus-5
claude.ai 利用可能; Maxプランのデフォルト、Proプランの最上位モデル
Claude Code 利用可能
Claude Cowork 利用可能
Amazon Bedrock anthropic.claude-opus-5として利用可能
AWS上のClaude Platform 利用可能、ファーストパーティID
Google Cloud claude-opus-5として利用可能
Microsoft Foundry 利用可能
GitHub Copilot 利用可能

高速モードはこのマトリックスの例外です。これはファーストパーティAPIでのみ動作するため、BedrockやGoogle Cloudのデプロイでは利用できません。

ApidogでのOpus 5リクエストのテスト

Opus 5を呼び出すということは、認証ヘッダー、JSONボディ、ストリーミング応答、そして再現する必要があるエラーを伴うHTTPエンドポイントにアクセスすることを意味します。Apidogはこれらを処理します。リクエストを送信し、コレクションに保存し、APIキーをボディに直接貼り付けるのではなく環境変数に保持し、応答をフィールドごとに読み取ることができます。

このモデルのための実践的なセットアップ:

  1. 共有コレクションにキーが置かれないよう、ANTHROPIC_API_KEYを環境変数として保存します。
  2. ベースラインのMessagesリクエストを1つ保存し、それをエフォートレベルごとに複製することで、同じプロンプトに対してlowhighxhighを並べて比較できます。
  3. ストリーミングを有効にした際にはSSEストリームを直接監視し、切り詰められた応答が実際にどこで停止したかを確認できます。
  4. 各応答のusageブロックを読み、キャッシュヒットが正常に行われているか、およびリクエストが消費した思考トークンの数を確認します。

以下にベースラインのリクエストを示します。

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
    ]
  }'

このリクエストは適応思考を実行します。なぜなら、思考がデフォルトでオンになっており、thinkingフィールドが存在しないからです。max_tokensには十分な余裕を与えてください。Opus 4.8では1,024で問題ありませんでしたが、ここでは途中で切り詰められる可能性があります。試すには、Apidogをダウンロードしてリクエストをインポートしてください。ステップバイステップのAPIガイドでは、ストリーミング、ツール使用、usageの読み取りについて詳しく説明しています。

Claude Opus 5は誰が使うべきか

Opus 5を選択すべきケース:

現状維持を検討すべきケース:

よくある質問 (FAQ)

Claude Opus 5のモデルIDは何ですか? 正確にclaude-opus-5という文字列で、日付サフィックスはありません。Amazon Bedrockではanthropic.claude-opus-5を使用し、Google CloudおよびAWS上のClaude Platformではclaude-opus-5を使用します。

Claude Opus 5の料金はいくらですか? 入力トークン100万あたり5ドル、出力トークン100万あたり25ドルで、これはOpus 4.8と同一であり、Fable 5の10ドルと50ドルの半分です。Batch APIはさらに半額の2.50ドルと12.50ドルにします。高速モードでは10ドルと50ドルに倍増します。

Claude Opus 5はFable 5より優れていますか? Anthropic自身の数値によれば、先行しているわけではなく、僅差です。Anthropicは、CursorBench 3.2でOpus 5がFable 5の0.5%以内にあると報告しており、OSWorld 2.0では3分の1のコストで先行していると主張していますが、Fable 5は「最も高性能な広くリリースされたモデル」という名称を保持しています。これらはベンダーが実施した結果であり、まだ独立した再現は行われていません。

Claude Opus 5のコンテキストウィンドウはどれくらいですか? デフォルトおよび最大で1,000,000トークンであり、ベータヘッダーや長文コンテキストのプレミアム料金はありません。Messages APIでの最大出力は128,000トークン、Batch APIではoutput-300k-2026-03-24ベータヘッダー使用時に300,000トークンです。

Opus 4.8からアップグレードするためにコードを変更する必要がありますか? モデルID以外にも変更が必要です。思考がデフォルトで実行されるようになったため、max_tokensを見直すか、意図しない切り捨てのリスクを負うことになります。また、thinking: {type: "disabled"}xhighまたはmaxエフォートの組み合わせは400エラーを返します。レベルが再調整されたため、エフォートスイープも再実行してください。

Claude Opus 5の知識カットオフはいつですか? 確実な知識とトレーニングデータの両方について2026年5月で、これは現在のどのClaudeモデルよりも最新です。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる