Claude Fable 5.1の料金は、入力トークン100万あたり10ドル、出力トークン100万あたり50ドルで、Fable 5と全く同じです。変更されたのはプロンプトキャッシュの読み取り料金で、Fable 5の1ドルから0.25ドル(Opus 5の0.50ドルの半分)に値下げされました。Anthropicの見積もりによると、これにより通常のワークロードは約25%安く、エージェントを多用するワークロードでは最大約45%安くなります。
このガイドでは、公式料金ページのすべての料金を説明し、独自のキャッシュヒット率を当てはめられるように25%および45%の主張を再現し、3つの実際のタスクあたりのコスト例を挙げ、料金を左右する要素をリストアップします。最初にモデルの概要を知りたい場合は、Claude Fable 5.1とは何かをご覧ください。
Claude Fable 5.1 料金表
| 料金 | Claude Fable 5.1 |
|---|---|
| 基本入力 | トークン100万あたり$10 |
| 出力 | トークン100万あたり$50 |
| 5分キャッシュ書き込み | トークン100万あたり$12.50 (入力の1.25倍) |
| 1時間キャッシュ書き込み | トークン100万あたり$20 (入力の2倍) |
| キャッシュ読み取り (ヒットまたは更新) | トークン100万あたり$0.25 (入力の0.025倍) |
| バッチAPI入力 | トークン100万あたり$5 |
| バッチAPI出力 | トークン100万あたり$25 |
| 長文コンテキストプレミアム | なし; 1Mのフルウィンドウは標準料金で課金 |
inference_geo: "us" |
すべてのトークンカテゴリで1.1倍 |
| 高速モード | 利用不可 (Opus 5およびOpus 4.8のみ) |
| プライオリティティア | サポート対象外 |
| ウェブ検索 | 検索1,000回あたり$10、プラスートークン料金 |
Claude Mythos 5.1も同様の料金です。バッチ割引とキャッシュ乗数が適用されるため、バッチ処理されたキャッシュ読み取りは100万あたり0.125ドルになります。
キャッシュ読み取り価格の比較
| モデル | 基本入力 | キャッシュ読み取り | 入力に対するキャッシュ読み取りの割合 |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0.25 | 2.5% |
| Claude Fable 5 | $10 | $1.00 | 10% |
| Claude Opus 5 | $5 | $0.50 | 10% |
| Claude Opus 4.8 | $5 | $0.50 | 10% |
| Claude Sonnet 5 | $2 | $0.20 | 10% |
| Claude Haiku 4.5 | $1 | $0.10 | 10% |
他のすべてのClaudeモデルでは、キャッシュヒットの価格は基本入力の10%です。Fable 5.1では2.5%です。実用的な効果としては、Fable 5.1のキャッシュされていない入力が2倍の価格であるにもかかわらず、Fable 5.1のキャッシュヒットはOpus 5のキャッシュヒットよりも安価です。ほとんどの入力トークンがキャッシュされたプレフィックスであるワークロードでは、Fable 5.1の実効入力レートはOpus 5を下回る可能性があります。

Sonnet 5について一点補足すると、Opus 5とSonnet 5の比較で9月の値上げが指摘されていましたが、Anthropicはそれをキャンセルしました。Sonnet 5は2ドルと10ドルに据え置かれます。
25%と45%の主張の再現
Anthropicはこれらの見積もりを裏付けるワークロードの内訳を公開していないため、これは彼らが示唆するキャッシュヒット率を示す再構築として扱い、彼らの正確なモデルとは見なさないでください。
リクエストが、キャッシュされていない入力トークンU、キャッシュされた入力トークンC、出力トークンOを持つとします。Fable 5での100万あたりのコストは10U + 1.0C + 50Oです。Fable 5.1では10U + 0.25C + 50Oです。節約額は0.75Cであり、節約率は0.75C / (10U + C + 50O)です。
典型的なチャットスタイルのワークロード。1つのリクエストあたり、キャッシュされたトークンが20,000、キャッシュされていない入力トークンが2,000、出力トークンが1,500だとします。Fable 5: 10(0.002) + 1.0(0.02) + 50(0.0015) = $0.02 + $0.02 + $0.075 = $0.115。Fable 5.1: $0.02 + $0.005 + $0.075 = $0.100。節約率: 13%。Anthropicの25%に到達するには、キャッシュされた部分が出力に対して相対的により大きくなる必要があります。例えば、同じ1,500の出力トークンに対して60,000のキャッシュされたトークンがある場合、$0.155対$0.110となり、29%の節約になります。
エージェントループ。150,000トークンのキャッシュされたプレフィックスを各ツール呼び出しの40ターンで再読み込みし、1ターンあたり1,000のキャッシュされていないトークンを追加し、1ターンあたり800の出力トークンを生成するエージェントを考えます。Fable 5での1ターンあたりのコスト: 10(0.001) + 1.0(0.15) + 50(0.0008) = $0.01 + $0.15 + $0.04 = $0.20。Fable 5.1では: $0.01 + $0.0375 + $0.04 = $0.0875。節約率: 1回限りのキャッシュ書き込みを除くと、1ターンあたり56%の節約。40ターンで$8.00対$3.50です。実際のほとんどのエージェントが持つキャッシュ書き込みとキャッシュされていないターンを追加すると、Anthropicの「最大45%」はこの範囲に快適に収まります。
ここから導き出されるルールは、節約は出力に対するキャッシュされた入力の比率に比例するということです。出力が非常に多いワークロード(短いプロンプトからの長い生成)では、変化はほとんど認識されません。プレフィックスが非常に多いワークロード(エージェント、大きな安定したコンテキストを持つRAG、複数ターンのサポートボット)では、その効果を最大限に享受できます。
タスクあたりのコスト例3選
3つの例すべてで、Fable 5.1が標準料金で、5分間のキャッシュ書き込みが1回支払われると仮定します。
1. 単一のコードレビュー。入力トークン30,000(差分+システムプロンプト)、出力トークン4,000、キャッシュなし。入力$0.30、出力$0.20。合計: $0.50。Opus 5での同じレビューは$0.25です。これは、何もキャッシュされていないため、Fable 5.1が単純に2倍の価格になるケースです。
2. 25ターンのサポート会話。12,000トークンの安定したシステムプロンプトが1回キャッシュされ(書き込みに$0.15)、その後25ターンそれぞれで300のキャッシュされていない入力トークンと250の出力トークンが追加され、プレフィックスはキャッシュから提供されます。会話全体でのキャッシュされていない入力: 7,500トークン = $0.075。キャッシュ読み取り: 25 x 12,000 = 300,000トークン = $0.075。出力: 6,250トークン = $0.3125。合計: 約$0.61。Fable 5では、キャッシュ読み取りだけで$0.30となり、合計で約$0.84になります。
3. 2時間かかるエージェントによるビルド。20,000トークンから200,000トークンに増加するプレフィックス(平均110,000トークンがキャッシュ)に対して120回のツール呼び出しターン、1ターンあたり1,500のキャッシュされていないトークン、1ターンあたり1,200の出力トークン、およびプレフィックスの増加に伴う約6回のキャッシュ更新。キャッシュ読み取り: 120 x 110,000 = 13.2Mトークン = $3.30。キャッシュされていない入力: 180,000トークン = $1.80。出力: 144,000トークン = $7.20。キャッシュ書き込み: 約660,000トークンを$12.50で = $8.25。合計: 約$20.55。Fable 5では、キャッシュ読み取りが$3.30ではなく$13.20となり、合計で約$30.45になります。これは、出力が依然として最大の項目である実行において、33%の節約となります。
例3では、キャッシュ書き込みが2番目に大きなコストになっていることに注目してください。これは、安価な読み取りの裏返しです。ミスはヒットの40倍であるため、セッション中にキャッシュをリセットする操作(システムプロンプトの再構築、以前のターンの編集、ツール配列の変更など)は、Fable 5での定常状態と比較してはるかにコストがかかります。
料金を左右する要素
Effort(労力)。 output_config.effortは出力トークンに最も影響を与える要素であり、出力は100万あたり$50です。Fable 5.1に関するAnthropicのガイダンスはhighから始めることであり、彼らの主張では、mediumは低コストでFable 5の品質にほぼ匹敵し、lowはタスクあたりのコストでOpusやSonnetと競合することが多いとのことです。独自の評価でスイープを実行してください。メッセージごとのeffortベータ機能を使用すると、ルーチン的なターンではlowに設定し、難しいターンではキャッシュをリセットせずに引き上げることができます。
キャッシュを温かく保つ。プロンプトキャッシングが割引の要素です。読み取りが$0.25、書き込みが$12.50の場合、5分TTLの損益分岐点は1ヒットです。5分から60分のアイドル期間の場合、5分TTLでmax_tokens: 0のキープアライブ再送信は、1時間TTLの2倍の書き込み料金を支払うよりも通常安価です。また、このモデルで思考ブロックを維持する追加専用の規律はキャッシュも維持します。セッション中にsystemやtoolsを再構築しない、変更には会話途中のシステムメッセージを使用する、ターンごとのリマインダーにはターンスコープのメッセージを使用する、といったことが挙げられます。
待てるものはバッチ処理する。Batch APIはすべてを半額にするため、Fable 5.1のバッチリクエストは$5と$25となり、Opus 5の同期料金と同じです。評価、バックフィル、夜間ドキュメント処理はそこへ。fallbacksはバッチでは拒否されるため、拒否された項目は手動で再送信する必要があることに注意してください。
ルートごとにティアを選択する。Anthropic自身のドキュメントでは、Opus 5から始め、高いeffort設定のOpus 5でも不十分な場合にFable 5.1に移行するよう述べています。Opus 5が評価をクリアするルートでは、何も得られないまま二倍の料金を支払うことになります。Fable 5.1とOpus 5の比較は、ワークロードごとの決定について詳しく説明しています。
ツールオーバーヘッドに注意する。ツールを使用するすべてのリクエストには、隠れたツール使用システムプロンプトが含まれます。AnthropicはOpus 5のカウント(286トークン)を公開していますが、Fable 5.1の数値はまだ公開していないため、トークンカウントエンドポイントで測定してください。ブラウザツールセットは約6,600トークン、コンピュータツールセットは約4,500トークンがリクエストごとに追加され、これらは初回送信後にすべてキャッシュされます。
拒否は無料、再試行は有料。出力が発生する前の分類器による拒否は課金されません。サーバーサイドのフォールバックは、再試行のフォールバックモデルの料金が課金され、Anthropicのフォールバッククレジットは切り替えのキャッシュコストを返金します。拒否を独自のメトリックとして計測し、Fable 5.1の支出のうちどれだけがOpus 5によって処理されているかを把握してください。
Claude APIの請求額を削減するためのガイドに記載されている一般的なテクニックのほとんどは、Fable 5.1ではキャッシュ読み取りの計算が有利になるという点を除いて、依然として適用されます。
Fable 5.1で利用できないもの
高速モードはOpus 5およびOpus 4.8専用で、$10および$50です。Fable 5.1の出力を高速化するためにお金を払う方法はありません。Fable 5.1またはMythos 5.1ではプライオリティティアはサポートされていませんが、Fable 5では引き続き利用できるため、それに依存するエンタープライズのキャパシティプランニングはFable 5に留まるか、Opus 5に移行する必要があります。また、データ保持ゼロ(ZDR)はAnthropicが明示的に許可しない限り利用できません。ZDR組織は、すべてのリクエストで400エラーを受け取ります。
Apidogで実際の費用を確認する
リクエストのコストを知る唯一信頼できる方法はusageオブジェクトであり、それを最も速く読み取る方法はテストコレクションです。Apidogで、プロダクションのシステムプロンプトをcache_control付きのリクエストとして保存し、それを2回送信します。そして、1回目の送信ではusage.cache_creation_input_tokensに、2回目の送信ではusage.cache_read_input_tokensにアサーションを追加します。次に、各フィールドにそのレートを乗算し、リクエストあたりのコストをログに記録するポストレスポンススクリプトを追加します。プロンプトやツール定義を変更するたびにコレクションを実行すると、請求に影響が出る前にキャッシュを破壊する編集を捕捉できます。Apidogをダウンロードして構築してください。APIウォークスルーで正確なリクエストが示されています。
ClaudeアプリでのFable 5.1の料金
APIの料金はトークンごとです。Claudeアプリでは、Fable 5.1はプランによって測定されます。Maxプランには、週間の利用制限の最大50%まで追加料金なしでFableモデルが含まれ、その後は利用クレジットで継続されます。Proおよび標準チームシートでは、最初のメッセージからFable 5.1が利用クレジットで測定されます。エンタープライズ標準シートでは、プラン制限を超えて利用するには利用クレジットを有効にする必要があり、利用ベースのエンタープライズは標準APIレートで請求されます。セーフガードによって別のモデルにルーティングされたリクエストは、Fableの料金では請求されません。無料および最安値のパスガイドで、その意味が実践的に解説されています。
よくある質問
Claude Fable 5.1の料金は100万トークンあたりいくらですか?入力が$10、出力が$50で、Fable 5から変更はありません。キャッシュ読み取りは100万あたり$0.25、キャッシュ書き込みは$12.50(5分)と$20(1時間)、バッチAPIは$5と$25です。
Claude Fable 5.1はFable 5より安いですか?トークンあたりでは安くありません。実際には、プロンプトキャッシングを使用するものであれば安くなります。キャッシュ読み取りが100万あたり$1から$0.25に下がったためです。Anthropicの見積もりでは、一般的なワークロードで25%安く、エージェントを多用するワークロードでは最大45%安くなります。出力の多いワークロードではほとんど変化がありません。
Claude Fable 5.1はOpus 5より安いですか?キャッシュされていない場合は安くありません。ちょうど2倍の価格です。キャッシュされている場合は状況が逆転し、Fable 5.1のキャッシュヒット($0.25)はOpus 5のキャッシュヒット($0.50)の半分になります。出力は依然として$50対$25なので、出力の多いルートではOpus 5が有利です。
Claude Fable 5.1には高速モードやプライオリティティアがありますか?どちらもありません。高速モードはOpus 5およびOpus 4.8専用です。プライオリティティアはFable 5ではサポートされていますが、Fable 5.1ではサポートされていません。
Claude Fable 5.1には長文コンテキストプレミアムがありますか?ありません。1Mトークンのフルウィンドウは標準レートで課金され、キャッシュとバッチの割引が適用されます。
Claude Fable 5.1はBedrockまたはGoogle Cloudでいくらですか?これらのプラットフォームは独自の価格を設定しており、地域エンドポイントには10%のプレミアムが追加されます。AWSおよびMicrosoft Foundry上のClaude Platformは、Claude Consumption Unitsを通じて標準APIレートで課金されます。当社のクラウド可用性ガイドで、各プラットフォームでの設定について説明しています。
