クロード ソネット 5.5 料金:API、キャッシュ、バッチ、プランを含む全コスト内訳

Claude Sonnet 5.5の料金:100万トークンあたり2ドル/10ドル、キャッシュ読み込み0.20ドル、バッチ処理は半額。費用計算例、労力コスト、プラン料金。

Ashley Goolam

Ashley Goolam

29 9月 2026

クロード ソネット 5.5 料金:API、キャッシュ、バッチ、プランを含む全コスト内訳

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Claude Sonnet 5.5のClaude APIでの費用は、Sonnet 5と同じく、入力トークン100万個あたり2ドル、出力トークン100万個あたり10ドルです。キャッシュ読み取りは100万個あたり0.20ドル、バッチAPIでは両方の料金が半額になり1ドルと5ドルです。1Mのフルコンテキストウィンドウは標準料金で請求され、高速モードは提供されていません。Sonnet 5の9月1日からの3ドル/15ドルへの値上げは中止され、現在2ドル/10ドルが標準価格となっています。

このガイドでは、Claude Sonnet 5.5の価格の全項目を一覧し、算術計算を示しながら3つの費用例を解説し、なぜ努力(effort)がトークン単価よりも請求額に大きく影響するのかを説明します。このモデルを初めて使用しますか? Claude Sonnet 5.5とは何か、またはClaude Sonnet 5.5を無料で使う方法から始めてください。ご自身のトラフィックと数字を比較するには、Apidogからリクエストを送信し、各レスポンスのusageブロックを読んでください。

Claude Sonnet 5.5 API料金表

Anthropicの料金ドキュメントより、100万トークン(MTok)あたりの価格は以下の通りです。

項目 100万トークンあたりの価格
入力 $2.00
5分キャッシュ書き込み $2.50
1時間キャッシュ書き込み $4.00
キャッシュ読み取り $0.20
出力 $10.00
バッチ入力 $1.00
バッチ出力 $5.00

以下の3つの詳細が支払額に影響します。

Sonnet 5.5の定価比較

モデル 入力 出力 備考
Claude Sonnet 5.5 $2 $10 キャッシュ読み取り $0.20; 1Mコンテキスト; 高速モードなし
Claude Sonnet 5 $2 $10 キャッシュ読み取り $0.20; $3/$15への値上げは中止
Claude Opus 5.5 $4 $20 キャッシュ読み取り $0.20; 高速モード $8/$40
Claude Haiku 4.5 $1 $5 20万コンテキスト
GPT-6 Sol $2 $10 キャッシュ入力90%オフ; 87.2万コンテキスト
GPT-6 Luna $0.10 $0.50 1Mコンテキスト

Sonnet 5.5は、入力、出力、キャッシュ書き込みにおいてOpus 5.5の半額です。GPT-6 Solとは全く同じ2ドル/10ドルの定価を共有しているため、どちらを選ぶかはタスクごとの結果次第となります。背景については、Claude Sonnet 5の料金設定、2026年9月のAIモデル価格戦争、およびGPT-6 Solの料金設定をご覧ください。

実践例:実際のリクエスト費用

各項目の計算式:トークン数 ÷ 1,000,000 × 100万トークンあたりの価格。各項目を計算し、合算します。

例1:チャット形式のリクエスト1件

入力トークン3,000個、出力トークン800個、キャッシュなし。

これらのリクエストを1,000回行うと14ドルかかります。出力はトークン全体の21%ですが、請求額の57%を占めるため、プロンプトの長さよりも出力の長さがより重要になります。

例2:5万トークンのプレフィックスを再読み込みするエージェント

エージェントループが、同じ5万トークンのプレフィックス(システムプロンプト、ツール、リポジトリコンテキスト)を20回の呼び出しで送信します。ここではプレフィックスのみが課金対象です。

キャッシュなし:20 × 50,000 = 1,000,000トークン; 1,000,000 ÷ 1,000,000 × $2 = $2.00

キャッシュあり、5分間の書き込みの場合:

これにより1.685ドルの節約、約84%の削減になります。5分間の書き込みは、呼び出しがその時間枠内で行われる場合にのみ効果を発揮します。より遅いループの場合、1時間書き込みの費用は50,000 ÷ 1,000,000 × $4 = $0.20となり、合計は$0.20 + $0.19 = $0.39で、キャッシュなしの場合と比較して約80%の削減となります。Opusでも同様の計算が当社のプロンプトキャッシュ費用計算で示されています。読み取り料金$0.20は同じです。

例3:1万件のリクエストのバッチジョブ

例1と同じ形式で、バッチAPIを通じて送信されます。

バッチはまた、`output-300k-2026-03-24`ベータ版により、出力上限を128Kトークンから300Kトークンに引き上げます。

トークン単位ではなく、タスク単位のコスト

料金表はトークンの費用を教えてくれますが、タスクで消費されるトークン数は教えてくれません。この後者の数字は、モデル間の料金差よりも努力(effort)によってはるかに大きく変動します。

Anthropicによると、Sonnet 5.5は「前身モデルよりもタスクあたりのコストが最大30%低い」とテストで述べられています。発表記事では、あらゆる努力レベルでのコストも示されています。Terminal-Bench 4.0の実行はAnthropic独自のもので、FrontierCodeはCognitionが実行し、インデックスコストはArtificial Analysisによるものです。

努力レベル Terminal-Bench 4.0 (スコア, 1試行あたりの費用) FrontierCode v1.1 (スコア, 1タスクあたりの費用) AAインデックス (スコア, 実行費用)
低 20.0%, $0.76 29.3%, $0.19 35.8, $544
中 28.8%, $0.83 36.5%, $0.24 40.7, $701
高 43.0%, $1.94 49.4%, $0.42 46.7, $1,176
超高 61.5%, $5.30 52.1%, $1.59 51.9, $2,738
最大 70.6%, $12.54 46.2%, $20.78 56.0, $8,977

注目すべき点:

最大(max)での冗長性ももう一つの落とし穴です。OfficeChaiによるArtificial Analysisのデータ分析では、Sonnet 5.5は最大(max)でインデックスタスクあたり約193,000の出力トークンを生成し、タスクあたりの費用はSonnet 5よりも約50%高くなるとされています。Simon WillisonはHacker Newsで、最大(max)努力の実行が128,000の思考トークンを消費し、回答を生成する前に枯渇したと報告しました。

費用を削減する6つのレバー

  1. 意図的に努力レベルを設定する。 APIはデフォルトで`high`、Claude CodeとClaudeアプリはデフォルトで`medium`です。Anthropicのプロンプティングガイドでは、チャットには`medium`または`low`を推奨し、明確な品質向上がある場合にのみ`xhigh`または`max`を使用するよう提案しています。Sonnet 5の設定を引き継がないでください。スケールが再調整されました。
  2. 思考がオフになっていた場所で`between_tools`を使用する。 `thinking: {"type": "disabled"}`は現在400を返します。`low`、`medium`、`high`では`{"type": "between_tools"}`がそれに取って代わります。
  3. 再利用するものはすべてキャッシュする。 キャッシュ可能な最小プロンプトは512トークン(Sonnet 5では1,024トークン)です。リクエスト間でトップレベルの`effort`を変更するとキャッシュが無効になるため、安定した設定を維持してください。
  4. 待機可能なものをバッチ処理する。 入力と出力が半額になります。
  5. `max_tokens`を正直に保つ。 Anthropicのガイドでは、`stop_reason: "max_tokens"`を失敗したレスポンスとして扱っているため、切り詰められた回答は何も提供されないまま費用が発生します。
  6. 不要な作業を削減する。 Sonnet 5.5は、要求していないテスト、ドキュメント、ファイルを追加したり、`xhigh`や`max`で追加のレビューラウンドを開始したりします。Anthropicが提案するシステムプロンプトの段落により、品質を変えることなく最大(max)でのセッションコストが約3分の1削減されました。

Sonnet 5.5のその他の支払い場所

代わりにクレジットを探していますか? 無料のClaude Sonnet 5.5 APIはありますかをご覧ください。

Apidogでリクエストごとの費用を追跡する

すべてのMessagesレスポンスには、input_tokens、output_tokens、およびキャッシュカウントを含むusageオブジェクトが含まれています。これがあれば、Apidogであらゆる呼び出しの費用を計算するのに十分です。

  1. キーをANTHROPIC_API_KEYという環境変数として保存します。
  2. 同じプロンプトで、各努力レベル(low、medium、high)ごとにこのリクエストを一度保存します。
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "between_tools"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. 呼び出しの費用を計算し、切り詰められた場合に失敗するポストプロセッサを追加します。
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
  1. これら3つすべてを実行し、usage.output_tokensと費用を並べて比較します。キャッシュを使用する場合は、キャッシュカウントをそれぞれの料金で追加してください。

完全なリクエストの手順は、Claude Sonnet 5.5 APIの使用方法にあります。

よくある質問

Claude Sonnet 5.5は100万トークンあたりいくらですか? Claude APIでは入力が2ドル、出力が10ドルです。キャッシュ読み取りは0.20ドルです。バッチAPIは1ドルと5ドルを請求します。

Sonnet 5.5はSonnet 5より高価ですか? いいえ。トークンあたりの価格は同じであり、AnthropicはテストにおいてSonnet 5.5のタスクあたりの費用が最大30%低いと述べています。

20万トークンを超えると追加料金がかかりますか? いいえ。1Mのフルコンテキストウィンドウは標準料金で請求されます。

Sonnet 5.5に高速モードはありますか? いいえ。高速モードはOpus 5.5、Opus 5、Opus 4.8でのみ利用可能です。

Claude Sonnet 5.5は無料ですか? Claudeチャットアプリでは無料プランで誰でもチャットできます。APIはプリペイドクレジットで動作します。無料APIガイドではクレジットプログラムについて説明しています。

次のステップ:ご自身のワークロードの費用を計算する

最も一般的な3つのリクエスト形式をとり、それぞれを2つの努力レベルで実行し、usageの数値を上記の表と掛け合わせてください。`medium`で品質基準を維持できるか、`high`で追加のトークン分の価値があるかをすぐに確認できます。Apidogをダウンロードして、これらのリクエストと費用スクリプトを並行して管理してください。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる