ジェミニ3.6 フラッシュの価格:2026年の実質費用

Gemini 3.6 Flashの料金体系を解説:入力100万トークンあたり1.50ドル、出力100万トークンあたり7.50ドル(思考トークン込み)、キャッシング費用、無料枠、および月額費用の計算例。

Ashley Innocent

Ashley Innocent

22 7月 2026

ジェミニ3.6 フラッシュの価格:2026年の実質費用

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Gemini 3.6 Flashは、入力トークン100万個あたり1.50ドル、出力トークン100万個あたり7.50ドルです。これは、置き換えられるモデルよりも安価です。Googleは2026年7月21日にこの更新をリリースし、API料金を監視している人にとっての目玉はシンプルです。主力であるFlashティアが同時に高速化され、低価格になりました。

このガイドでは、予算を組むために必要なすべての数値について詳しく説明します。トークンごとの料金、コンテキストキャッシュが追加するもの、無料枠でカバーされるもの、そしてコードを一行書く前に月々の費用を予測できる具体的な例です。ここにあるすべての数値は、Google自身のGemini API料金ドキュメント発表から引用しています。まずモデルの全体像を知りたい場合は、Gemini 3.6 Flashとは何かをお読みください。

数字の前に一点、命名について。主力モデルはバージョン3.6に移行しましたが、より安価なFlash-Liteティアは3.5のままです。同じリリースでもバージョンが混在しています。これを理解しておけば、料金体系がすっきりとわかります。

Gemini 3.6 Flashの料金概要

項目 料金
入力 トークン100万個あたり1.50ドル
出力(推論トークンを含む) トークン100万個あたり7.50ドル
コンテキストキャッシュ、キャッシュされた入力読み取り トークン100万個あたり0.15ドル
コンテキストキャッシュ、ストレージ トークン100万個あたり1.00ドル/時間
無料枠 Google AI Studio経由で利用可能(レート制限あり)

すぐに注目すべき点が2つあります。出力料金には推論トークンが含まれており、モデルが回答する前の推論も、別途ではなく100万トークンあたり7.50ドルの出力レートで課金されます。また、コンテキストキャッシュには2つの部分があります。キャッシュされた入力に対する安価な読み取りレートと、キャッシュを保持している間にかかる時間ごとのストレージ料金です。キャッシュは繰り返されるコンテキストの費用を節約しますが、無料ではないため、同じプロンプトプレフィックスを頻繁に再利用する場合にのみ節約効果が現れます。

Gemini 3.5 Flashとの比較

出力レートは、3.5 Flashのトークン100万個あたり9.00ドルから、3.6 Flashでは7.50ドルに引き下げられました。これだけで出力トークンあたり約17%のコスト削減になります。

さらに重要なのは、GoogleがDeepMind Flashモデルページで報告していることです。3.6 Flashは、同じタスクに対して約17%少ない出力トークンを生成します。少ないステップで推論し、マルチステップの作業でのツール呼び出しも少なくなります。つまり、より少ないトークンに対してより低い料金を支払うことになります。この2つの要素が複合的に作用することで、以下で実際の計算で示します。

古いモデルに対して予算を組んでいる場合、Gemini 3.5 Flashの料金の内訳を比較して読む価値があります。全機能とベンチマークの比較については、Gemini 3.6 Flash vs 3.5 Flashをご覧ください。あなたの財布にとっての簡単な結論は、3.6 Flashは置き換えるモデルよりも実行コストが低く、トークン節約が積み重なる長いエージェント的なワークロードではその差がさらに広がります。

無料枠で得られるもの

Google AI Studioを通じて利用できる、実際の無料枠があります。クレジットカードなしでGemini 3.6 Flashを呼び出し、無料でプロトタイプを作成できます。

制限については正直になりましょう。無料枠はレート制限があるため、本番のトラフィックではなく、プロトタイピングや軽度のテスト向けに作られています。また、Googleは無料枠のデータを使用して製品を改善する可能性があります。これは、機密データ、専有データ、顧客データを無料枠に置くべきではないことを意味します。実運用に移行する際は、そのようなデータ利用規約が適用されない有料キーに移行してください。

無料枠でできることと設定方法の完全なガイドについては、Gemini 3.6 Flashを無料で利用する方法をご覧ください。ここに「無制限の無料」オプションはないため、製品リリース後は有料利用に移行することを計画してください。

費用計算例

例えば、多くを読み取り、少しだけ書き込むエージェントを運用するとします。1日あたり200万入力トークンと50万出力トークンです。これは、ドキュメントを取り込み、短い回答を返すような検索重視のアシスタントにとって現実的な形です。

Gemini 3.6 Flashでの日額請求は以下の通りです。

次に複合効果について。3.5 Flashで同じタスクが60万出力トークンを生成したとします。3.6 Flashでは17%削減され、上記で予算を組んだ約50万トークンになります。出力行のみを比較してみましょう。

出力側だけで1日あたり1.65ドル、月あたり約49.50ドルの削減になります。価格の引き下げとトークン削減がそれぞれ約17%に過ぎないにもかかわらず、出力コストは約31%削減されます。より安価なトークンとより少ないトークンの組み合わせこそが、真の節約を生み出すのです。

Flash-Liteはさらに安価

タスクがシンプルな場合は、主力モデルの下に別のティアがあります。Gemini 3.5 Flash-Liteは、入力トークン100万個あたり0.30ドル、出力トークン100万個あたり2.50ドルです。キャッシュはトークン100万個あたり0.03ドルに加え、ストレージはトークン100万個あたり1時間1.00ドルと同じ料金がかかります。また、毎秒約350出力トークンと高速で動作します。

Flash-Liteで同じ200万入力トークンと50万出力トークンのワークロードを実行すると、日額は約1.85ドル、月額は約55.50ドルになります。これは、同じトークン数で3.6 Flashよりも約70%安価です。

ただし、品質が異なります。Flash-Liteは、分類、抽出、ルーティング、短い構造化された応答など、大量で複雑度の低い作業向けに調整されています。それは同じものの劣化したバージョンではなく、コスト、品質、レイテンシーの曲線上の異なる点に位置します。タスクがシンプルでボリュームが多い場合はFlash-Liteを、より複雑な推論には3.6 Flashを使用してください。詳細については、Gemini 3.5 Flash-Liteとは何か、次にGemini 3.5 Flash-Lite vs 3.6 Flashを読んで、ルートごとに適切なティアを選択してください。

コストを管理し測定する方法

請求額を抑える4つの方法:

  1. 繰り返されるコンテキストをキャッシュする。すべてのリクエストが長いシステムプロンプトや同じ参照ドキュメントを共有する場合、コンテキストキャッシュの読み取り料金はトークン100万個あたり1.50ドルではなく0.15ドルになります。ただし、トークン100万個あたり1時間1.00ドルのストレージ料金を忘れないでください。したがって、キャッシュはプレフィックスを1回ではなく、1時間以内に頻繁に再利用する場合に効果を発揮します。
  2. プロンプトを簡潔にする。出力は入力の5倍の価格ですが、肥大化した入力も規模が大きくなると積み重なります。定型文を削除し、最大出力トークン数を制限することで、暴走した応答に驚かされることがなくなります。
  3. シンプルなタスクをFlash-Liteにルーティングする。分類や抽出は安価なティアに送り、複数ステップの推論には3.6 Flashを確保します。すべてのタスクに1つのモデルを選ぶよりも、混合ルーティングの方が効果的な場合が多いです。
  4. 実際のトークン使用量を測定する。推定は当てになりません。すべてのGemini応答に含まれるusageMetadataは、その呼び出しで消費された入力、出力、推論トークンの数を正確に示しており、それが請求書の基となる数値です。

最後の点が、APIクライアントがその価値を発揮するところです。Apidogでは、Gemini APIへのPOSTリクエストを作成し、環境変数にキーを保存して、実際のプロンプトに対して実際の呼び出しを行うことができます。応答から直接usageMetadataフィールドを読み取ってリクエストごとの実際のトークン数を確認し、出力トークンが倍増するようなプロンプトの変更が、静かに請求額を倍増させるのではなくテストを失敗させるようにアサーションを追加します。さらに、これらのAPIテストを定期的に実行するようスケジュールして、コストの回帰を早期に検知することも可能です。一緒に試してみませんか?Apidogをダウンロードし、本番環境に組み込む前にGeminiエンドポイントにリクエストを送信してみてください。

よくある質問

Gemini 3.6 Flashはトークン100万個あたりいくらですか?入力は1.50ドル、出力は7.50ドルです。コンテキストキャッシュの読み取りはトークン100万個あたり0.15ドルで、ストレージ料金はトークン100万個あたり1時間1.00ドルです。

出力料金には推論トークンが含まれますか?はい。モデルが回答する前に行う推論は、100万トークンあたり7.50ドルの出力レートで課金されます。推論トークンに対する別途の料金はありませんが、出力合計にカウントされるため、推論が多いほど請求額は大きくなります。

本当に無料枠はありますか?はい、Google AI Studioを通じて利用でき、レート制限があります。これはプロトタイピングやテストを目的としており、本番環境向けではありません。Googleは無料枠のデータを使用して製品を改善する可能性があるため、機密データは有料キーで管理してください。

Gemini 3.6 Flashは3.5 Flashより安いですか?はい。出力レートは9.00ドルから7.50ドルに下がり、3.6 Flashは同じタスクで約17%少ない出力トークンを使用します。これら両方の効果が重なり、実際の出力料金は約31%削減される可能性があります。

代わりにFlash-Liteを使用すべきなのはいつですか?タスクがシンプルでボリュームが多い場合です。入力0.30ドル、出力2.50ドルで、Flash-Liteは同じトークン数で約70%安価で高速ですが、3.6 Flashの方がより複雑な推論をうまく処理します。

Gemini 3.6 Flashは、価格が下がりながらモデルが同時に改善された珍しい料金改定です。入力1.50ドル、出力7.50ドルとして予算を組み、推論トークンが出力レートに含まれることを忘れず、残りの費用を削減するためにキャッシュとFlash-Liteルーティングを活用してください。Gemini APIのコストがリリース間でどのように変化したかの歴史的背景については、Gemini 3.0 APIのコストの内訳が役立つ参考になります。そして、Apidogで自身の呼び出しを測定し、計画したトークン数が実際に支払うべきものと一致するようにしてください。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる