Claude Sonnet 5.5のClaude APIでの費用は、Sonnet 5と同じく、入力トークン100万個あたり2ドル、出力トークン100万個あたり10ドルです。キャッシュ読み取りは100万個あたり0.20ドル、バッチAPIでは両方の料金が半額になり1ドルと5ドルです。1Mのフルコンテキストウィンドウは標準料金で請求され、高速モードは提供されていません。Sonnet 5の9月1日からの3ドル/15ドルへの値上げは中止され、現在2ドル/10ドルが標準価格となっています。
このガイドでは、Claude Sonnet 5.5の価格の全項目を一覧し、算術計算を示しながら3つの費用例を解説し、なぜ努力(effort)がトークン単価よりも請求額に大きく影響するのかを説明します。このモデルを初めて使用しますか? Claude Sonnet 5.5とは何か、またはClaude Sonnet 5.5を無料で使う方法から始めてください。ご自身のトラフィックと数字を比較するには、Apidogからリクエストを送信し、各レスポンスのusageブロックを読んでください。
Claude Sonnet 5.5 API料金表
Anthropicの料金ドキュメントより、100万トークン(MTok)あたりの価格は以下の通りです。
| 項目 | 100万トークンあたりの価格 |
|---|---|
| 入力 | $2.00 |
| 5分キャッシュ書き込み | $2.50 |
| 1時間キャッシュ書き込み | $4.00 |
| キャッシュ読み取り | $0.20 |
| 出力 | $10.00 |
| バッチ入力 | $1.00 |
| バッチ出力 | $5.00 |
以下の3つの詳細が支払額に影響します。
- 米国限定の推論。
inference_geo: "us"は、Claude APIおよびAWS上のClaude Platformのすべてのトークンカテゴリで1.1倍の費用がかかります(入力2.20ドル、出力11ドル、キャッシュ読み取り0.22ドル)。FoundryのUSデータゾーンデプロイメントも同様に1.1倍の費用がかかります。BedrockとGoogle Cloudは個別に料金を設定しています。 - 長文コンテキストのプレミアムなし。 90万トークンのリクエストも、9千トークンのリクエストも、トークンあたりの費用は同じです。
- Sonnet 5と同じトークナイザー。 トークン数は変更されずに引き継がれます。
Sonnet 5.5の定価比較
| モデル | 入力 | 出力 | 備考 |
|---|---|---|---|
| Claude Sonnet 5.5 | $2 | $10 | キャッシュ読み取り $0.20; 1Mコンテキスト; 高速モードなし |
| Claude Sonnet 5 | $2 | $10 | キャッシュ読み取り $0.20; $3/$15への値上げは中止 |
| Claude Opus 5.5 | $4 | $20 | キャッシュ読み取り $0.20; 高速モード $8/$40 |
| Claude Haiku 4.5 | $1 | $5 | 20万コンテキスト |
| GPT-6 Sol | $2 | $10 | キャッシュ入力90%オフ; 87.2万コンテキスト |
| GPT-6 Luna | $0.10 | $0.50 | 1Mコンテキスト |
Sonnet 5.5は、入力、出力、キャッシュ書き込みにおいてOpus 5.5の半額です。GPT-6 Solとは全く同じ2ドル/10ドルの定価を共有しているため、どちらを選ぶかはタスクごとの結果次第となります。背景については、Claude Sonnet 5の料金設定、2026年9月のAIモデル価格戦争、およびGPT-6 Solの料金設定をご覧ください。
実践例:実際のリクエスト費用
各項目の計算式:トークン数 ÷ 1,000,000 × 100万トークンあたりの価格。各項目を計算し、合算します。
例1:チャット形式のリクエスト1件
入力トークン3,000個、出力トークン800個、キャッシュなし。
- 入力:3,000 ÷ 1,000,000 × $2 = $0.006
- 出力:800 ÷ 1,000,000 × $10 = $0.008
- 合計:$0.006 + $0.008 = $0.014
これらのリクエストを1,000回行うと14ドルかかります。出力はトークン全体の21%ですが、請求額の57%を占めるため、プロンプトの長さよりも出力の長さがより重要になります。
例2:5万トークンのプレフィックスを再読み込みするエージェント
エージェントループが、同じ5万トークンのプレフィックス(システムプロンプト、ツール、リポジトリコンテキスト)を20回の呼び出しで送信します。ここではプレフィックスのみが課金対象です。
キャッシュなし:20 × 50,000 = 1,000,000トークン; 1,000,000 ÷ 1,000,000 × $2 = $2.00
キャッシュあり、5分間の書き込みの場合:
- 呼び出し1でキャッシュを書き込む:50,000 ÷ 1,000,000 × $2.50 = $0.125
- 呼び出し2から20で読み取る:19 × 50,000 = 950,000トークン; 950,000 ÷ 1,000,000 × $0.20 = $0.19
- 合計:$0.125 + $0.19 = $0.315
これにより1.685ドルの節約、約84%の削減になります。5分間の書き込みは、呼び出しがその時間枠内で行われる場合にのみ効果を発揮します。より遅いループの場合、1時間書き込みの費用は50,000 ÷ 1,000,000 × $4 = $0.20となり、合計は$0.20 + $0.19 = $0.39で、キャッシュなしの場合と比較して約80%の削減となります。Opusでも同様の計算が当社のプロンプトキャッシュ費用計算で示されています。読み取り料金$0.20は同じです。
例3:1万件のリクエストのバッチジョブ
例1と同じ形式で、バッチAPIを通じて送信されます。
- 入力:10,000 × 3,000 = 30,000,000トークン; 30 × $1 = $30
- 出力:10,000 × 800 = 8,000,000トークン; 8 × $5 = $40
- バッチ合計:$70 (標準料金30 × $2 + 8 × $10 = $140に対し)
バッチはまた、`output-300k-2026-03-24`ベータ版により、出力上限を128Kトークンから300Kトークンに引き上げます。
トークン単位ではなく、タスク単位のコスト
料金表はトークンの費用を教えてくれますが、タスクで消費されるトークン数は教えてくれません。この後者の数字は、モデル間の料金差よりも努力(effort)によってはるかに大きく変動します。
Anthropicによると、Sonnet 5.5は「前身モデルよりもタスクあたりのコストが最大30%低い」とテストで述べられています。発表記事では、あらゆる努力レベルでのコストも示されています。Terminal-Bench 4.0の実行はAnthropic独自のもので、FrontierCodeはCognitionが実行し、インデックスコストはArtificial Analysisによるものです。
| 努力レベル | Terminal-Bench 4.0 (スコア, 1試行あたりの費用) | FrontierCode v1.1 (スコア, 1タスクあたりの費用) | AAインデックス (スコア, 実行費用) |
|---|---|---|---|
| 低 | 20.0%, $0.76 | 29.3%, $0.19 | 35.8, $544 |
| 中 | 28.8%, $0.83 | 36.5%, $0.24 | 40.7, $701 |
| 高 | 43.0%, $1.94 | 49.4%, $0.42 | 46.7, $1,176 |
| 超高 | 61.5%, $5.30 | 52.1%, $1.59 | 51.9, $2,738 |
| 最大 | 70.6%, $12.54 | 46.2%, $20.78 | 56.0, $8,977 |
注目すべき点:
- Terminal-Benchでは、最大(max)の費用は高(high)の約6.5倍。 ($12.54 ÷ $1.94 = 6.46)。Artificial Analysisのインデックス費用は、最大(max)で実行する場合、低(low)の場合の約16.5倍 ($8,977 ÷ $544) でした。
- より高い努力(effort)が常に良いとは限らない。 FrontierCodeのスコアは、超高(xhigh)の52.1%から最大(max)の46.2%に低下し、タスクあたりの費用は13倍 ($20.78 ÷ $1.59) に上昇しました。Anthropicの脚注によると、最大(max)ではモデルがサブエージェントを展開するレビュー機能をより頻繁に実行し、Cognitionが調査したケースではタイムアウトや範囲外の編集を引き起こしたとのことです。
- Opusは低い努力レベルでも競争力がある。 Opus 5.5は中(medium)でTerminal-Benchのスコアが57.6%で$2.94でしたが、Sonnet 5.5は高(high)で43.0%で$1.94でした。当社のSonnet 5.5 vs Opus 5.5比較では、そのトレードオフについて詳しく説明しています。
最大(max)での冗長性ももう一つの落とし穴です。OfficeChaiによるArtificial Analysisのデータ分析では、Sonnet 5.5は最大(max)でインデックスタスクあたり約193,000の出力トークンを生成し、タスクあたりの費用はSonnet 5よりも約50%高くなるとされています。Simon WillisonはHacker Newsで、最大(max)努力の実行が128,000の思考トークンを消費し、回答を生成する前に枯渇したと報告しました。
費用を削減する6つのレバー
- 意図的に努力レベルを設定する。 APIはデフォルトで`high`、Claude CodeとClaudeアプリはデフォルトで`medium`です。Anthropicのプロンプティングガイドでは、チャットには`medium`または`low`を推奨し、明確な品質向上がある場合にのみ`xhigh`または`max`を使用するよう提案しています。Sonnet 5の設定を引き継がないでください。スケールが再調整されました。
- 思考がオフになっていた場所で`between_tools`を使用する。 `thinking: {"type": "disabled"}`は現在400を返します。`low`、`medium`、`high`では`{"type": "between_tools"}`がそれに取って代わります。
- 再利用するものはすべてキャッシュする。 キャッシュ可能な最小プロンプトは512トークン(Sonnet 5では1,024トークン)です。リクエスト間でトップレベルの`effort`を変更するとキャッシュが無効になるため、安定した設定を維持してください。
- 待機可能なものをバッチ処理する。 入力と出力が半額になります。
- `max_tokens`を正直に保つ。 Anthropicのガイドでは、`stop_reason: "max_tokens"`を失敗したレスポンスとして扱っているため、切り詰められた回答は何も提供されないまま費用が発生します。
- 不要な作業を削減する。 Sonnet 5.5は、要求していないテスト、ドキュメント、ファイルを追加したり、`xhigh`や`max`で追加のレビューラウンドを開始したりします。Anthropicが提案するシステムプロンプトの段落により、品質を変えることなく最大(max)でのセッションコストが約3分の1削減されました。
Sonnet 5.5のその他の支払い場所
- Claudeプラン (claude.com/pricing):無料プランは0ドルで、チャットでSonnetが含まれますが、Claude Codeは含まれません。Proは年間契約で月額17ドル、月額契約で20ドルです。Maxは月額100ドルから。チームシートは年間/月額で20ドル/25ドル(スタンダード)、または100ドル/125ドル(プレミアム)です。これらのいずれもAPIアクセスは含まれません。
- GitHub Copilot: Pro(月額10ドル)、Pro+、Max、Business、Enterpriseは、プロバイダーの定価で請求されます。Copilot Proには、月額1,500のAIクレジット(1クレジットあたり0.01ドル)が含まれており、これは約15ドル分のトークン、またはおよそ1,070件の例1のリクエスト($15 ÷ $0.014)に相当します。Copilot FreeおよびStudentでは選択できません。
- Cursor: 他のモデルのプール(Pro、Pro Plus、Ultra)から同等の料金で、米国限定のエンドポイントにはさらに10%が加算されます($2.20/$11)。
- OpenRouter: $2/$10、または`:batch`バリアントでは$1/$5です。`:free`バリアントはありません。
- Vercel AI Gateway: $2/$10で、キャッシュ読み取りは$0.20です。$5の無料クレジットではSonnet 5.5はカバーされません。
- Bedrock、Google Cloud、Foundry: 各クラウド独自の料金ページを参照してください。Bedrockは標準ティアのみをサポートしており、バッチは利用できません。
代わりにクレジットを探していますか? 無料のClaude Sonnet 5.5 APIはありますかをご覧ください。
Apidogでリクエストごとの費用を追跡する
すべてのMessagesレスポンスには、input_tokens、output_tokens、およびキャッシュカウントを含むusageオブジェクトが含まれています。これがあれば、Apidogであらゆる呼び出しの費用を計算するのに十分です。

- キーを
ANTHROPIC_API_KEYという環境変数として保存します。 - 同じプロンプトで、各努力レベル(
low、medium、high)ごとにこのリクエストを一度保存します。
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- 呼び出しの費用を計算し、切り詰められた場合に失敗するポストプロセッサを追加します。
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
- これら3つすべてを実行し、
usage.output_tokensと費用を並べて比較します。キャッシュを使用する場合は、キャッシュカウントをそれぞれの料金で追加してください。
完全なリクエストの手順は、Claude Sonnet 5.5 APIの使用方法にあります。
よくある質問
Claude Sonnet 5.5は100万トークンあたりいくらですか? Claude APIでは入力が2ドル、出力が10ドルです。キャッシュ読み取りは0.20ドルです。バッチAPIは1ドルと5ドルを請求します。
Sonnet 5.5はSonnet 5より高価ですか? いいえ。トークンあたりの価格は同じであり、AnthropicはテストにおいてSonnet 5.5のタスクあたりの費用が最大30%低いと述べています。
20万トークンを超えると追加料金がかかりますか? いいえ。1Mのフルコンテキストウィンドウは標準料金で請求されます。
Sonnet 5.5に高速モードはありますか? いいえ。高速モードはOpus 5.5、Opus 5、Opus 4.8でのみ利用可能です。
Claude Sonnet 5.5は無料ですか? Claudeチャットアプリでは無料プランで誰でもチャットできます。APIはプリペイドクレジットで動作します。無料APIガイドではクレジットプログラムについて説明しています。
次のステップ:ご自身のワークロードの費用を計算する
最も一般的な3つのリクエスト形式をとり、それぞれを2つの努力レベルで実行し、usageの数値を上記の表と掛け合わせてください。`medium`で品質基準を維持できるか、`high`で追加のトークン分の価値があるかをすぐに確認できます。Apidogをダウンロードして、これらのリクエストと費用スクリプトを並行して管理してください。
