Claude Opus 5は2026年7月24日に、入力トークン100万あたり5ドル、出力トークン100万あたり25ドルでローンチされました。これはAnthropicがOpus 4.8に課金したのと同じレートであり、Fable 5のちょうど半分のコストです。ローンチ時の報道はすべてこの見出しを掲げ、それはそれなりに正確です。
報道が省略したのは、請求書を左右する部分です。キャッシュへの書き込み、キャッシュヒット、バッチレート、高速モード、地域乗数、そして静かにトークン数を変動させる動作変更です。このガイドでは、完全な料金表を示し、実際の請求リクエストの形状に基づいてコスト計算を行うことで、出荷前に予算を立てられるようにします。ご自身のトラフィックに対して数値をチェックするには、Apidogからリクエストを送信し、すべての応答に含まれるusageブロックを読み取ってください。
Claude Opus 5の完全な料金表
以下のレートはすべてAnthropicの料金ドキュメントに由来し、モデルID claude-opus-5に適用されます。
| トークンカテゴリ | トークン100万あたりの料金 |
|---|---|
| 入力(標準) | $5.00 |
| 出力(標準) | $25.00 |
| プロンプトキャッシュ書き込み、5分TTL | $6.25 |
| プロンプトキャッシュ書き込み、1時間TTL | $10.00 |
| キャッシュヒットおよびリフレッシュ | $0.50 |
| バッチAPI入力 | $2.50 |
| バッチAPI出力 | $12.50 |
| 高速モード入力 | $10.00 |
| 高速モード出力 | $50.00 |
いくつか注目すべき点があります。
- キャッシュヒットは標準入力の10分の1のコストです。これは料金表の中で最大のレバーです。
- 5分間のキャッシュ書き込みは、標準入力に対して1.25倍のプレミアムがかかり、1時間書き込みは2倍かかります。
- バッチは、入力と出力の両方で一律50%オフです。
- 高速モードは、2.5倍の出力速度に対して標準料金のちょうど2倍です。これは研究プレビューであり、Anthropic独自のAPIのみ(Bedrock、Google Cloud、Microsoft Foundryでは利用不可)、バッチAPIとは併用できません。
- 長文コンテキストのプレミアムはありません。100万トークンのコンテキストウィンドウはデフォルトであり最大であり、しきい値を超えたトークンはすべて同じ5ドルで請求されます。一部の競合モデルは、特定のコンテキスト層を超えると高額になりますが、Opus 5にはそれがありません。

最後の点は、単一のリクエストに厳しい上限を設定しています。最も高価なMessages APIコールは、100万入力トークンと128kの最大出力で、$5.00 + $3.20、つまり$8.20です。バッチAPIでは、output-300k-2026-03-24ベータヘッダーで最大出力が300kに上昇する場合、出力側の上限は$3.75です。
基準点:4.8と同じ、Fable 5の半分
Opus 5は、比較対象となる可能性が高いモデルの中で、どのような位置付けになるかを示します。
| モデル | 入力 / Mトークン | 出力 / Mトークン |
|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
| Claude Fable 5 | $10.00 | $50.00 |
| Claude Sonnet 5(導入期、2026年8月31日まで) | $2.00 | $10.00 |
| Claude Sonnet 5(2026年9月1日より) | $3.00 | $15.00 |
この表には2つの重要な読み取り方があります。
まず、Opus 4.8からのアップグレードは、トークンあたりのコストが一切かかりません。料金は同じで、4.5、4.6、4.7、4.8を通じて変更がありません。モデルIDの変更は、ユニットエコノミクスには影響しません。変化するのはトークン量であり、これについては後述します。古いIDを使用している限り、Opus 4.8の料金内訳は引き続き適用されます。
次に、Opus 5はFable 5の半分です。Anthropicの発表数値によると、Opus 5はCursorBench 3.2でFable 5のピークの0.5%以内に収まり、OSWorld 2.0では約3分の1のタスク単価でFable 5を上回ると主張しています。これらはOpus 5ローンチ投稿からのベンダー提供数値であり、2026年7月25日現在、誰も独自に再現していません。これらは確定した結果ではなく、主張として扱ってください。Opus 5とFable 5の比較では、価格差がどこで価値があるのかを詳しく説明しており、Fable 5の料金ページには上位の詳細が記載されています。
具体例1:単一のリクエスト
最もシンプルな形状から始めましょう。8,000入力トークンと1,200出力トークンでの要約コールです。
- 入力:8,000 / 1,000,000 x $5.00 = $0.040
- 出力:1,200 / 1,000,000 x $25.00 = $0.030
- 合計:1コールあたり$0.070
月に10,000コールの場合、これは$700です。同じワークロードをFable 5で実行すると、1コールあたり$0.140、つまり月あたり$1,400かかります。Sonnet 5を導入料金で利用すると、1コールあたり$0.028、つまり$280です。
入力が約7倍多いリクエストであっても、請求額の43%を占めるのが出力であることに注目してください。出力は入力の5倍のコストがかかるため、出力量がほとんどの人が予想するよりも早く支配的になります。これはOpus 4.8よりもOpus 5でより重要になります。なぜなら、思考トークンが出力として請求され、適応的思考がデフォルトでオンになっているからです。
具体例2:キャッシングを使用した長いエージェントセッション
ここに本当の費用と本当の節約があります。120,000トークンのシステムプロンプトとリポジトリコンテキストを持つコーディングエージェントが、40ターンのセッションを実行します。各ターンでは1,500トークンの新しい会話が追加され、2,500出力トークンが生成されます。
プロンプトキャッシングなしの場合、毎回完全なコンテキストを再送信します。
| 項目 | トークン | レート | 費用 |
|---|---|---|---|
| 入力 (120,000 x 40 + 60,000 新規) | 4,860,000 | $5.00 | $24.30 |
| 出力 (2,500 x 40) | 100,000 | $25.00 | $2.50 |
| 合計 | $26.80 |
120,000トークンのプレフィックスに5分間のプロンプトキャッシュを使用した場合:
| 項目 | トークン | レート | 費用 |
|---|---|---|---|
| キャッシュ書き込み、1回 | 120,000 | $6.25 | $0.75 |
| キャッシュ読み取り(39ターン) | 4,680,000 | $0.50 | $2.34 |
| 新規入力 (1,500 x 40) | 60,000 | $5.00 | $0.30 |
| 出力 (2,500 x 40) | 100,000 | $25.00 | $2.50 |
| 合計 | $5.89 |
これは78%の削減であり、出力は請求額の9%ではなく42%を占めるようになります。適切にキャッシュを使用すれば、次は出力を最適化することが重要になります。
5分間のTTLに関する注意点が1つあります。キャッシュの読み取りによってTTLがリフレッシュされるため、5分未満の間隔でターンが続くセッションは、単一の書き込みでキャッシュが「温かい」状態を保ちます。エージェントがそれよりも長くアイドル状態になる場合は、100万トークンあたり10ドルの1時間書き込みを使用してください。その場合、書き込み費用は$0.75から$1.20に増加し、合計は$6.34になりますが、それでもキャッシュなしの実行と比較して76%の削減になります。
具体例3:バッチ処理
同期的な応答を必要としないものについては、バッチAPIが一律50%オフになります。1,200入力トークンと150出力トークンのドキュメントを50,000件処理する場合を考えます。
| パス | 入力コスト | 出力コスト | 合計 |
|---|---|---|---|
| 標準 | 60 Mトークン x $5.00 = $300.00 | 7.5 Mトークン x $25.00 = $187.50 | $487.50 |
| バッチ | 60 Mトークン x $2.50 = $150.00 | 7.5 Mトークン x $12.50 = $93.75 | $243.75 |
同じトークン、同じモデルで、$243.75節約できます。トレードオフはレイテンシーであり、品質ではありません。分類、エンリッチメント、または評価ジョブが非同期配信を許容する場合、標準エンドポイントで実行すると予算の半分が無駄になります。
具体例4:高速モードの実際のコスト
高速モードでは、レートが$10/$50に倍増し、およそ2.5倍の出力速度になります。具体例1のリクエストを高速モードで実行すると、入力$0.080 + 出力$0.060、つまり1コールあたり$0.140となり、ちょうど2倍になります。
これにより、Opus 5はFable 5の標準レートと全く同じ価格になります。つまり、機能ではなくレイテンシーのためにフロンティアレベルの価格を支払っていることになります。ユーザーがトークンが表示されるのを見るインタラクティブな場面では価値がありますが、バックグラウンド作業では正当化しにくいでしょう。バッチAPIとは併用できないため、この2つのコスト削減策は設計上、相互に排他的です。
実際に請求額を変動させる4つのレバー
これら4つの要素はOpus 5に特有のものであり、どれだけの費用を節約できるかについても具体的に説明します。
1. プロンプトキャッシュの最小値が512トークンに引き下げられました
Opus 4.8ではキャッシュ可能な最小値が1,024トークンでしたが、Opus 5では512トークンになりました。以前は短すぎてキャッシュできなかったプロンプトも、キャッシュコントロールブロックを追加するだけでコード変更なしにキャッシュできるようになりました。
損益分岐点の計算は、ほとんどの人が思っているよりも優れています。キャッシュ書き込みは標準入力の1.25倍、読み取りは0.1倍のコストがかかります。キャッシュが有利になるポイントを解くと:
- 5分TTL:1.3リクエストで損益分岐点に達します。2回目のコールからすでに有利になります。
- 1時間TTL:2.1リクエストで損益分岐点に達します。3回目のコールからすでに有利になります。
具体的には、700トークンのシステムプロンプトをバーストで1,000回再利用する場合、キャッシュなしだと$3.50かかります。キャッシュありだと、書き込みに$0.0044、999回の読み取りに$0.00035、合計で$0.354かかります。このプロンプトはOpus 4.8ではまったくキャッシュできませんでした。
2. バッチで50%オフ
前述しましたが、レバーとして改めて強調する価値があります。同期的な応答が本当に必要なワークロードを監査してください。評価実行、バックフィル、夜間の要約、コンテンツ分類は通常、必要ありません。
3. Effort low と medium がついに利用可能になりました
output_config.effortはモデルがどれだけ「考える」かを制御し、「考える」トークンは100万トークンあたり25ドルで出力として課金されます。Opus 5では努力レベルが再調整され、Anthropicはlowとmediumが以前のOpusモデルよりも大幅に強力になったと述べています。デフォルトはhighです。コーディングやエージェント作業ではxhighが推奨される開始点として残っています。
節約は思考トークン量に直接比例します。あるタスクがxhighで平均8,000の思考トークンを消費し、lowで1,500の思考トークンを消費する場合、6,500の出力トークン、つまりタスクあたり$0.1625を節約でき、100,000タスクで$16,250になります。これらの数値は例示であり、実際の差はプロンプトによって異なります。そのためAnthropicは、4.8の設定を引き継ぐのではなく、ご自身の評価に対して新しいエフォートスイープを実行することを推奨しています。エフォートパラメーターガイドでそのスイープについて説明しています。
1つ注意点があります。エフォートを下げると、思考トークンは減りますが、目に見える応答の長さは変わりません。Opus 5のデフォルトの応答や作成された成果物はOpus 4.8よりも長くなる傾向があり、エフォートはその問題を解決しません。より短い回答が欲しい場合は、より短い回答を要求してください。
4. ツール使用システムプロンプトのオーバーヘッド削減
ツール定義を送信すると、APIがシステムプロンプトを注入し、その分の料金が発生します。Opus 5では、autoまたはnoneのツール選択の場合、このオーバーヘッドは286トークンであり、Opus 4.8の290トークン、Opus 4.7の675トークンから減少しています。
この削減の規模について正直になりましょう。4.8と比較すると、4トークンの差は100万リクエストあたり$20であり、ノイズの範囲です。4.7と比較すると、389トークンの差は1リクエストあたり$0.001945、つまり100万リクエストあたり$1,945です。まだ4.7を使用している場合は大きな金額ですが、4.8では誤差の範囲です。
Claudeラインナップ全体に適用されるレバーについては、Claude APIの請求額を削減する方法に関するガイドでより詳しく説明しています。
見落とされがちな2つの項目
inference_geo: "us"乗数は1.1倍です。コンプライアンスまたはデータレジデンシーのために推論をUS専用インフラストラクチャに固定すると、すべてのトークンカテゴリが1.1倍に増幅されます。入力$5.50、出力$27.50、キャッシュヒット$0.55、バッチ$2.75 / $13.75となります。具体例1のワークロードは、月額$700から$770に上がります。50,000ドルの請求書では$5,000の項目となるため、設定する前に固定が必要か確認してください。
Priority TierはOpus 5ではサポートされていません。Opus 4.8では引き続き利用可能です。キャパシティプランニングがPriority Tierのコミットメントに依存している場合、これは移行における真の制約となります。Opus 4.8からOpus 5への移行ガイドでは、APIの破壊的変更とともにこれについても説明しています。
請求書に現れる動作の変更
トークンあたりのレートは請求額の半分です。トークン量は残りの半分であり、Opus 5の3つの動作変更は、何も対策しなければトークン量を増加させます。
- 思考がデフォルトでオンになっています。Opus 4.8では、
thinkingフィールドがないリクエストは思考なしで実行されました。Opus 5では、同じリクエストが適応的思考を実行し、これらのトークンは出力として請求されます。max_tokensは思考と応答を合わせて上限を設けるため、一部のワークロードでは切り捨てが発生し始める可能性もあります。 - Opus 5はサブエージェントへの委譲をより容易に行います。各サブエージェントは独自の請求対象トークンセットを持ちます。コストに敏感なワークロードでは、委譲を制限または範囲指定してください。
- Opus 5は促されなくても自身の作業を検証します。「自分の作業を再確認する」という指示を引き継いでいる場合、Anthropicのプロンプトガイドはそれらを削除するよう述べています。過剰な検証はトークンを消費します。
これらの変更はどれもトークンあたりの価格を変更しません。しかし、支払う金額はすべて変わります。
Apidogで実際の費用を確認する
推測をやめる最も速い方法は、すべての応答にあるusageオブジェクトを読み取ることです。これにはinput_tokens、output_tokens、cache_creation_input_tokens、およびcache_read_input_tokensが個別に報告されており、これはご自身のトラフィックに対して上記の計算をチェックするために必要な正確な内訳です。

ApidogはAPI開発およびテストプラットフォームであるため、これをうまく処理します。"model": "claude-opus-5"を指定してMessagesエンドポイントにリクエストを送信し、その後で:
- 保存されたリクエストをエフォートレベルごとに複製し、同じプロンプトで思考トークン量を並べて比較します。
usage.cache_read_input_tokensがゼロより大きいことをアサートし、サイレントに壊れたキャッシュが予期せぬ請求書としてではなく、失敗テストとして表示されるようにします。- キーをリクエストボディではなく環境変数として保存し、開発キーが本番規模のバッチを実行しないようにします。
- SSEストリームを監視し、長い生成で出力トークンがどこへ行くかを確認します。
Apidogをダウンロードして、Opus 5 APIガイドのウォークスルーと合わせてこれらのチェックを実行してください。
5ドル/25ドルで実際に何を購入しているのか
Opus 5は、能力あたりの価格設定において強力な位置を占めていますが、Claudeスタックの頂点ではありません。Fable 5はAnthropicが広くリリースしたモデルの中で最も高性能であり続けており、Opus 5はサイバーセキュリティの悪用や自律生物学研究においてはまだMythos 5に及びません。Anthropicはこれらを明確に述べています。正直なところ、これはフロンティアクラスの能力をフロンティア価格の半分で提供するものであり、その上には明確な上限が存在します。Mythosクラスモデルの解説では、そのラインより上に何があるかを説明しています。
ほとんどのチームにとって、本当の問題はOpus 5と最上位モデルの比較ではありません。ワークロードがそもそもOpusを必要とするのか、それともSonnet 5の2ドル/10ドル(2026年9月1日からは3ドル/15ドルに上昇)が40%の価格でタスクをこなせるのか、ということです。予算を確定する前に、ご自身の評価で両方を実行してみてください。完全な仕様と可用性は、私たちのClaude Opus 5概要に記載されており、Anthropicのモデル概要には公式な表があります。
FAQ
Claude Opus 5の費用はいくらですか? 標準APIでは、入力トークン100万あたり5ドル、出力トークン100万あたり25ドルです。キャッシュヒットは0.50ドル、バッチ実行は2.50ドル/12.50ドル、高速モードは10ドル/50ドルです。
Claude Opus 5はOpus 4.8よりも高価ですか? トークンあたりでは高価ではありません。レートは同じです。しかし、思考がデフォルトでオンになっており、デフォルトの応答が長くなるため、請求額は増加する可能性があります。同等性を仮定するのではなく、トークン量を測定してください。
100万トークンのコンテキストウィンドウに長文コンテキストの追加料金はありますか? いいえ。100万トークンのコンテキストウィンドウはデフォルトであり最大であり、長文入力に対するプレミアムティアはありません。
Claude Opus 5を最も安価に利用する方法は何ですか? キャッシュを積極的に利用し(512トークンの最小値により、ほとんどの再利用されるプレフィックスが対象となります)、緊急性の低いジョブはバッチAPIを通じて実行して一律50%オフにし、ご自身の評価に合格する最低限のエフォートレベルを探索してください。無料および最安値パスガイドに詳細があります。
地域固定には追加料金がかかりますか? はい。inference_geo: "us"を設定すると、キャッシュヒットやバッチを含むすべてのトークンカテゴリに1.1倍の乗数が適用されます。
