Anthropicは2026年5月28日にClaude Opus 4.8を出荷し、同日中にClaude API、Claudeアプリ、Claude Code、および主要なクラウドプラットフォームで利用可能にしました。これはClaudeファミリーの中で最も高性能なモデルで、複雑な推論、長期にわたるエージェント的なコーディング、および高い自律性を要する作業のために構築されています。APIモデルIDはclaude-opus-4-8です。
すでにOpus 4.7で構築している場合、アップグレードはモデルIDを1行変更するだけで済みます。主な変更点は新しい料金体系やより大きなコンテキストウィンドウではなく、どちらも変更ありません。変更されたのは品質です。Anthropicの発表によると、Opus 4.8は4.7と比較して、コードの欠陥が見過ごされる可能性が約4分の1になり、知らないことに対してより正直に答えます。このガイドでは、何が変更されたか、どうアクセスするか、そして切り替える価値があるかどうかについて説明します。
要約
初日に重要な3つの事実:
- モデルID
claude-opus-4-8:現在、Claude API、AWS、Vertex AI、およびMicrosoft Foundryで利用可能 - Opus 4.7と同じ価格:標準モードで入力トークン100万あたり5ドル、出力トークン100万あたり25ドル
- 1Mトークンのコンテキスト、128Kトークンの出力:4.7から変更なしのため、トークン予算は引き継がれます
これに加えて得られるもの:
- レスポンス全体にわたって、徹底性とトークン効率をトレードオフする新しい
effortパラメーター - モデルがリクエストごとにどの程度推論するかを決定する適応的思考
- Claude Codeのダイナミックワークフロー。1回のセッションで数百の並列サブエージェントを起動可能
- より正直になり、コードの欠陥を見逃しにくく、ツール呼び出しがより効率的になった
詳細なトークンごとの計算とコストシナリオについては、Opus 4.8の料金内訳を参照してください。構築を開始するには、Opus 4.8 APIガイドにジャンプしてください。
Opus 4.8で実際に新しくなったこと
Opus 4.8は4.7の仕様を維持しつつ、内部のモデルを改良しています。改善は主に4つの領域に集中しています。
コードの品質。 モデルが自身のミスをより頻繁に発見するようになりました。Anthropicの報告によると、4.7と比較して、レビューで見過ごされる欠陥が約4分の1に減少しました。エージェント的なコーディングでは、これは生成される差分に潜在的なバグが少なくなることを意味します。

正直さとアラインメント。 Opus 4.8は不確実性をより積極的に示し、根拠のない主張を減らします。Anthropicは、4.7と比較して詐欺や悪用への協力率も低いと報告しています。エージェントを無人で実行する場合、ベンチマークのポイントよりもその判断が重要になります。
ツール呼び出し。 モデルはツールをより効率的に選択し、無駄な呼び出しを減らすことで、エージェントループにおけるレイテンシーとトークン消費の両方を削減します。
Effortコントロール。 これはAPIで最も目立つ変更であり、専用のセクションを設ける価値があります。
Effortコントロール:1つのモデル、5つのギア
effortパラメーターを使用すると、Claudeがどの程度積極的にトークンを消費するかを調整できます。これはoutput_config内に存在し、low、medium、high、xhigh、maxの5つのレベルを受け入れます。デフォルトはAPIとClaude Codeを含むすべてのインターフェースでhighです。
{
"model": "claude-opus-4-8",
"max_tokens": 4096,
"messages": [{"role": "user", "content": "Refactor this module."}],
"output_config": { "effort": "xhigh" }
}
重要な詳細:effortは推論だけでなく、すべてのトークンに影響します。これにはテキスト、ツール呼び出し、関数引数が含まれます。effortを低く設定すると、Claudeはツール呼び出しを少なくし、より簡潔な応答を作成します。effortを高く設定すると、より深い分析と徹底的な作業が行われます。
AnthropicがOpus 4.8で推奨するガイドラインは、コーディングやエージェントタスクではxhighから開始し、ほとんどの推論を多用する作業ではhighを最低レベルとし、評価で低レベルでも品質が維持されることを確認した後にのみmediumまたはlowに下げることです。詳細はAnthropicのeffortドキュメントに記載されています。
手動予算に代わる適応的思考
Opus 4.8は適応的思考を使用します。thinking: {type: "adaptive"}を設定すると、モデルがリクエストごとにいつ、どの程度推論するかを決定します。high、xhigh、maxのeffortレベルでは、ほとんど常に深く思考します。より低いレベルでは、単純な問題では思考をスキップすることができます。
移行前に知っておくべきことの1つ:budget_tokensを使用した手動の拡張思考はOpus 4.8ではサポートされておらず、400エラーを返します。以前のOpusからこのパターンを引き継いでいる場合は、適応的思考とeffortパラメーターに切り替えてください。Opus 4.8 APIガイドで正確なリクエストの形式を説明しています。
Claude Codeのダイナミックワークフロー
最も目玉となる新機能はClaude Code内にあります。ダイナミックワークフローにより、単一のセッションで数百の並列サブエージェントを起動し、大規模で分岐するタスクを処理できます。その裏では、これはxhigh effortレベルと、会話の途中からシステムメッセージを受け入れるようになったMessages APIの更新が組み合わされています(以前は会話の開始時のみでした)。
この会話途中の機能により、オーケストレーターエージェントはタスクが進行するにつれてワーカーを生成する恒久的な許可を得ます。メカニズムや、生のAPIを通じて同様のオーケストレーションモードを構築する方法については、Claude Codeのダイナミックワークフロー詳細解説を参照してください。Claude Codeがエージェントの実行をどのように構造化するかについては、Claude Codeのエージェントハーネスアーキテクチャの解説が良い入門書です。
ベンチマークのハイライト
Anthropicの主要な数値はエージェント作業に焦点を当てています。
- エンドツーエンドのタスク完了を測定するスイートであるSuper-AgentベンチマークでGPT-5.5を凌駕
- Legal Agentベンチマークでトップに立ち、全体で10%を超える初のモデルとなった
- WebナビゲーションエージェントテストであるOnline-Mind2Webで84%
これらはエージェントスコアであり、チャットスコアではありません。これはOpus 4.8がどこをターゲットにしているかを示しています。他の最先端モデルとの直接比較については、Opus 4.8 vs GPT-5.5 vs Gemini 3.5をお読みください。古いGemini 3.5 vs GPT-5.5 vs Opus 4.7の比較は、4.7のベースラインとして依然として有効です。
Opus 4.8 vs Opus 4.7 一目でわかる比較
| 属性 | Opus 4.7 | Opus 4.8 |
|---|---|---|
| API ID | claude-opus-4-7 |
claude-opus-4-8 |
| 入力価格 | 1Mトークンあたり5ドル | 1Mトークンあたり5ドル |
| 出力価格 | 1Mトークンあたり25ドル | 1Mトークンあたり25ドル |
| コンテキストウィンドウ | 1Mトークン | 1Mトークン |
| 最大出力 | 128Kトークン | 128Kトークン |
| Effortレベル | lowからmax | lowからmax |
| 見過ごされたコード欠陥 | ベースライン | 約4分の1に減少 |
| 正直さ/アラインメント | ベースライン | 改善 |
| 知識カットオフ | 2026年1月 | 2026年1月 |
仕様は意図的に同一です。同じ料金で、より少ない間違いをするモデルを利用できるため、ほとんどのチームにとって移行のリスクは低いでしょう。モデルを切り替えた後、ツールスキーマと評価をテストし、その後リリースしてください。
Claude Opus 4.8へのアクセス方法
4つの主要なアクセス方法があります。
- Claude API:Messagesエンドポイントに対してモデルID
claude-opus-4-8を使用します。Opus 4.8 APIガイドから始めてください。 - Claudeアプリ:claude.aiでは有料プランのデフォルトのハイエンドモデルであり、無料プランではアクセスが制限されています。
- Claude Code:トップモデルとして利用可能で、ハイエフォートモードを選択するとダイナミックワークフローも利用できます。
- クラウドプラットフォーム:AWS(Bedrockでは
anthropic.claude-opus-4-8)、Vertex AI(claude-opus-4-8)、およびMicrosoft Foundryで利用可能ですが、コンテキストウィンドウは200Kトークンに制限されています。
まず有料APIプランなしで試したい場合は、Opus 4.8を無料で使う方法ガイドで合法的な低コストパスをカバーしています。
Opus 4.8は誰が使うべきか
Opus 4.8は、ワークロードスペクトラムの難しい部分のために構築されています。次のような場合に利用してください。
- サイレントバグが高価となる長期間のエージェントコーディングセッションを実行している場合
- エージェントが無人で健全な判断を下す必要がある場合
- 複数ステップのツール利用をオーケストレーションしており、無駄な呼び出しを減らしたい場合
- タスクが、単なる簡単な分類ではなく、真に最先端の推論を必要とする場合
大量の処理、レイテンシーに敏感な作業、または単純な作業には、より小さいモデルまたは低いeffortレベルの方が適しており、コストも安くなります。effortコントロールの目的は、ギアを変えるためにモデルを切り替える必要がなくなったことです。
Opus 4.8をリリースする前にテストする
モデルの切り替えは簡単に記述できますが、間違いも起こしやすいものです。ストリーミングチャンク、ツール呼び出しの検証、新しいoutput_configの形状、そして適応的思考の応答はすべて、コードがパースする必要のあるペイロードを変更します。claude-opus-4-8を本番環境にプッシュする前に、実際の要求をそれに対してリプレイし、出力を比較してください。

Apidogは、1つのワークスペースでMessages APIの全表面を処理します。
- Opus 4.8エンドポイントをリクエストとして保存し、
x-api-keyをアタッチして送信します。 - 同じリクエストで
claude-opus-4-7をclaude-opus-4-8に交換し、応答を比較します。 - ストリーミングされたチャンクが、チャンクごとのタイミングとともにインラインでレンダリングされるのを確認します。
effortレベルを変更したときにスキーマのずれをキャッチするアサーションを追加します。- エンドポイントをモックして、クレジットを消費せずにダウンストリームコードをテストできます。
Apidogをダウンロードし、Messagesエンドポイントにリクエストを向け、APIガイドからcURLスニペットを貼り付けてください。セットアップは約2分で完了します。
FAQ
Claude Opus 4.8はOpus 4.7より優れていますか? はい、品質において優れています。約4倍多くのコード欠陥を検出し、不確実性についてより正直であり、ツール呼び出しをより効率的に行います。価格、コンテキストウィンドウ、最大出力は同一なので、4.7に留まる理由はほとんどありません。
Opus 4.8の費用はいくらですか? 標準モードでは、入力トークン100万あたり5ドル、出力トークン100万あたり25ドルです。高速モードでは、2.5倍速い出力で10ドルと50ドルです。詳細な計算は料金内訳に記載されています。
Opus 4.8のコンテキストウィンドウはどれくらいですか? 同期Messages APIでは、入力が1Mトークン、出力が最大128Kトークンです。Batch APIはベータヘッダーを使用すると最大300Kトークンの出力をサポートします。Microsoft Foundryではコンテキストウィンドウは200Kトークンです。
Opus 4.8は拡張思考をサポートしていますか? 適応的思考(thinking: {type: "adaptive"})を使用し、モデルがどの程度推論するかを決定します。手動のbudget_tokens思考はサポートされておらず、400エラーを返します。
effortパラメーターとは何ですか? output_config内の設定で、Claudeがテキスト、ツール呼び出し、推論に費やすトークン量を制御します。レベルはlow、medium、high(デフォルト)、xhigh、maxです。
Opus 4.8を無料で利用できますか? 無料のAPIティアはありませんが、claude.aiの無料プランで制限付きで試すか、トライアルクレジットを通じて利用できます。無料アクセスガイドを参照してください。
ダイナミックワークフローとは何ですか? xhigh effortと会話中のシステムメッセージによって、1回のセッションで多数の並列サブエージェントを起動できるClaude Codeの機能です。詳細はダイナミックワークフローガイドに記載されています。
