ジェミニ4アルゴン料金:初回$2/$10、以降$4/$20、100万トークン回答の費用は?

ジェミニ4 Argonの料金:導入価格は100万トークンあたり入力2ドル/出力10ドル、通常価格は入力4ドル/出力20ドル。キャッシュされた入力は95%オフ。費用計算、100万トークンの回答例、および競合価格。

INEZA Felin-Michel

INEZA Felin-Michel

2 10月 2026

ジェミニ4アルゴン料金:初回$2/$10、以降$4/$20、100万トークン回答の費用は?

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Gemini 4 Argonは、導入期間中は100万入力トークンあたり2ドル、100万出力トークンあたり10ドル、その後は4ドルと20ドルがかかります。キャッシュされた入力は入力価格の95%オフで、これは導入期間中は100万トークンあたり0.10ドル、その後は0.20ドルに相当します。Googleは導入期間がどれくらい続くか発表しておらず、現時点ではまだArgonを購入できません。発表はされているものの一般提供されておらず、今日はFairwind Programのサイバーディフェンダーのみに展開されています。

button

この投稿では、その料金表を予算数値に変換し、7つの現行モデルとの比較、4つのシナリオ、タスクあたりのサードパーティコスト、および今すぐ設定すべきコスト管理について説明します。モデル自体については、Gemini 4 Argonとは何かから始めてください。アクセスについては、Gemini 4 Argonは無料かを参照してください。Apidogで、今日呼び出せるモデルに対してコストアサーションを構築し、後でモデル名をスワップすることができます。

fe

料金表

GoogleはGemini 4 Argonの発表投稿で料金を公開し、注釈1で導入後の料金について「導入期間終了後、100万入力トークンあたり4ドル、100万出力トークンあたり20ドルの料金が適用されます」と述べています。

Gemini 4 Argon、100万トークンあたり 導入期間 標準(導入後)
入力 $2.00 $4.00
キャッシュされた入力(入力の95%オフ) $0.10 $0.20
出力 $10.00 $20.00
応答あたりの最大出力(Google) 100万トークン 100万トークン
1回の完全な100万トークン出力のコスト $10.00 $20.00

キャッシュ料金は、Googleの95%ルール(2ドル x 0.05、4ドル x 0.05)から算出されています。Googleは入力コンテキストウィンドウやモデルIDを公開していません。出力制限は「以前の64Kトークンから増加し」100万トークンであると述べていますが、少なくともVals AIのようなサードパーティの評価者によれば、テストした構成での最大出力は262Kです。

Argon vs 現在のフロンティアモデルとGeminiモデル

すべての料金は100万トークンあたりです。

モデル 入力 キャッシュされた入力 出力 最大出力
Gemini 4 Argon (導入期間) $2 $0.10 $10 1M
Gemini 4 Argon (標準) $4 $0.20 $20 1M
GPT-6 Astra $10 $1 $50 128,000
Claude Opus 5.5 $4 $0.20 $20 128K (Batchで300K、ベータ)
Claude Sonnet 5.5 $2 $0.20 $10 128K (Batchで300K、ベータ)
GPT-6.1 Sol $2 $0.10 $10 128,000
Claude Fable 5.1 $10 $0.25 $50 128K
gemini-3.1-pro-preview (プロンプト <=200K / >200K) $2 / $4 $0.20 / $0.40 $12 / $18 65,536
gemini-3.8-flash (導入期間 / 2027-01-01以降) $0.75 / $1.50 $0.075 / $0.15 $3.75 / $7.50 65,536

競合モデルの料金は、各ベンダーのページから引用されています。OpenAIのGPT-6 Astraページ、Anthropicの料金ページ、GoogleのGemini API料金ページ。

価格と機能の比較については、Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5を参照してください。

思考トークンは出力として課金される

現在のGeminiモデルでは、思考トークンは出力として課金されます。Googleの思考に関するドキュメントには、「応答料金は出力トークンと思考トークンの合計である」と記載されています。GoogleはArgonについて具体的に文書化していませんが、同じルールが適用されると想定してください。GoogleはArgonの評価を「最高の思考設定で」実行したと述べているため、「100万出力トークンあたり10ドル」は回答と推論の合計と解釈してください。

4つのシナリオ

以下の数値はすべて、トークン数を100万で割り、100万トークンあたりのレートを掛けたものです。シナリオ1~3はキャッシングなしを想定しています。

1. 一般的なAPI呼び出し:20K入力、5K出力

1日1,000回の呼び出しの場合、導入期間中は90ドル、標準では180ドルになります。同じ呼び出しはClaude Opus 5.5では$0.18、GPT-6 Astraでは$0.45($0.20 + $0.25)、gemini-3.1-pro-previewでは$0.10($0.04 + $0.06)、gemini-3.8-flashの導入期間中の料金では約$0.034($0.015 + $0.019)です。

2. 長いエージェントターン:200K入力、50K出力

GPT-6 Astraは$4.50($2.00 + $2.50)を請求します。gemini-3.1-pro-previewは$1.00($0.40 + $0.60)を請求しますが、200Kはその階層の境界線です。より長いプロンプトは$4/$18で課金されます。Argonにも同様の階層がある場合、より長いターンはより費用がかかります。

3. 1回の最大出力応答:100万トークンの出力

出力のみの場合、導入期間中は1,000,000 / 100万 x $10 = $10.00、標準では$20.00です。100Kトークンのプロンプト(導入期間中$0.20、標準$0.40)を追加すると、呼び出し料金は$10.20または$20.40になります。

この表の他のどのモデルも、1回の同期応答でこれだけの出力を生成することはできません。競合モデルは128K、以前のGemini Proは65,536で上限が設定されています。Valsがリストしている262Kの最大出力の場合、完全な応答の費用は導入期間中で約$2.62、標準で$5.24です。エンジニアリング面(タイムアウト、ストリーミング、ゲートウェイ)については、Gemini 4 Argonの100万出力トークンで説明されています。

4. 10回再利用されるキャッシュされた500Kトークンプロンプト

同じ500Kトークンのコードベースまたは契約セットを10回送信し、それぞれ5Kトークンの出力がある場合を考えます。最初の呼び出しでキャッシュを構築するために全入力料金を支払い、その後の9回はキャッシュから読み取ると仮定します。

10回の呼び出し、500Kプロンプト、各5K出力 導入期間 標準
入力、キャッシュなし(10 x 500K) $10.00 $20.00
入力、キャッシュあり(1回フル + 9回キャッシュ) $1.00 + 9 x $0.05 = $1.45 $2.00 + 9 x $0.10 = $2.90
出力(10 x 5K) $0.50 $1.00
キャッシングを含む合計 $1.95 $3.90
キャッシングなしの合計 $10.50 $21.00

キャッシングにより、入力料金は85.5%削減されます。2つの注意点があります。GoogleはArgonがキャッシュストレージに対して課金するかどうか(gemini-3.1-pro-previewは100万トークンあたり1時間あたり4.50ドルを課金するため、500Kトークンを1時間保持するには2.25ドルが追加されます)をまだ発表しておらず、500Kのプロンプトは3.1 Proの200Kのラインを超えています。Argonの標準キャッシュ料金はOpus 5.5の$0.20と一致するため、Claude Opus 5.5プロンプトキャッシングコスト計算の損益分岐点ロジックが引き継がれます。

トークンあたりの価格はタスクあたりのコストではない

Artificial Analysisは、Gemini 4 Argon (High) のIntelligence Indexを実行するためのタスクあたり$1.99(導入期間中の価格)をリストしています。The Decoderは、同じ実行が標準価格で$3.98になると述べています。AAはArgonのスコアを53としており、これはGPT-6 Astra(最大)と同じで、Astraのタスクあたり$3.26とリストされています。

問題はトークン量です。AAは、Argon(high)のタスクあたり約62Kの出力トークンに対し、最大設定のAstraでは約27Kと、約2.3倍の出力トークン数を計上しています。導入期間中のタスクあたりの出力:62,000 / 100万 x $10 = $0.62に対し、Astraでは27,000 / 100万 x $50 = $1.35です。標準では、The DecoderのArgonのタスク全体の数値($3.98)は、Argonの標準料金がAstraの60%以下であるにもかかわらず、AAのAstra(最大)の$3.26を上回ります。

Vals AIも同じパターンを示しています。Vals IndexでのArgonのテストあたり$15.68に対し、Claude Opus 5.5は$32.14、Claude Sonnet 5.5は$21.34、GPT-6.1 Solは$3.24とリストされており、Argonは$4/$20の標準料金でリストされています。Sonnet 5.5とGPT-6.1 SolはArgonの導入期間中の料金を名目上共有していますが、テストあたりのコストは6倍以上も離れています。

料金表ではなく、自身のトークン数から予算を立ててください。

Argonリリース前に設定すべきコスト管理

そのアサーションの計算式:

コスト = キャッシュされていない入力 / 1,000,000 x 入力レート
     + キャッシュされた入力   / 1,000,000 x キャッシュレート
     + (出力 + 思考) / 1,000,000 x 出力レート

Googleがまだ価格設定していないもの

導入期間の長さと$4/$20が始まる日付。200Kを超えるプロンプトがより高価になるかどうか。BatchまたはFlexの料金(3.1 Proには両方あり、入力$1/$2、出力$6/$9)。キャッシュストレージ料金。レート制限。そして、無料枠がそもそも存在するのか。

よくある質問

Gemini 4 Argonは100万トークンあたりいくらかかりますか? 導入期間中は入力2ドル、出力10ドルで、その後は4ドルと20ドルです。キャッシュされた入力は95%オフで、0.10ドル、その後は0.20ドルです。

導入期間中の料金はいつまで続きますか? Googleはまだ発表していません。発表投稿には終了日や期間の記載がありません。

思考トークンは出力として課金されますか? 現在のGeminiモデルではそうです。GoogleはArgonのルールを具体的に文書化していません。

100万トークンの出力応答はいくらかかりますか? 導入期間中の料金では10ドル、標準料金では20ドルで、入力料金は含まれません。

ArgonはClaude Opus 5.5やGPT-6 Astraよりも安いですか? トークンあたりでは、標準ArgonはOpus 5.5と同等で、Astraより60%安いです。タスクあたりでは、トークン量によります。Artificial Analysisによると、ArgonはAstraの出力トークンの約2.3倍を使用しました。より安価なGeminiを今すぐ利用するには、Gemini 3.8 Flashの料金を参照してください。

Argonは今日から支払って利用できますか? いいえ。Fairwind Programのパートナーのみに展開されています。有料API顧客とGoogle AI Ultraのサブスクライバーはその後ですが、日付は未定です。

今すぐ予算を立て、後で測定する

現在のトラフィックのトークン数を$2/$10と$4/$20で掛ければ、Argonの導入期間中と標準の料金範囲が分かります。次に測定を構築します。Apidogをダウンロードし、GEMINI_MODELを変数としてgemini-3.8-flashに対するリクエストを保存し、usageMetadataに対するコストアサーションを追加します。GoogleがモデルIDを公開したら、1つの値を変更して、初日から実際の呼び出しあたりのコストを確認できます。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる