Gemini 4 Argonは、導入期間中は100万入力トークンあたり2ドル、100万出力トークンあたり10ドル、その後は4ドルと20ドルがかかります。キャッシュされた入力は入力価格の95%オフで、これは導入期間中は100万トークンあたり0.10ドル、その後は0.20ドルに相当します。Googleは導入期間がどれくらい続くか発表しておらず、現時点ではまだArgonを購入できません。発表はされているものの一般提供されておらず、今日はFairwind Programのサイバーディフェンダーのみに展開されています。
この投稿では、その料金表を予算数値に変換し、7つの現行モデルとの比較、4つのシナリオ、タスクあたりのサードパーティコスト、および今すぐ設定すべきコスト管理について説明します。モデル自体については、Gemini 4 Argonとは何かから始めてください。アクセスについては、Gemini 4 Argonは無料かを参照してください。Apidogで、今日呼び出せるモデルに対してコストアサーションを構築し、後でモデル名をスワップすることができます。

料金表
GoogleはGemini 4 Argonの発表投稿で料金を公開し、注釈1で導入後の料金について「導入期間終了後、100万入力トークンあたり4ドル、100万出力トークンあたり20ドルの料金が適用されます」と述べています。
| Gemini 4 Argon、100万トークンあたり | 導入期間 | 標準(導入後) |
|---|---|---|
| 入力 | $2.00 | $4.00 |
| キャッシュされた入力(入力の95%オフ) | $0.10 | $0.20 |
| 出力 | $10.00 | $20.00 |
| 応答あたりの最大出力(Google) | 100万トークン | 100万トークン |
| 1回の完全な100万トークン出力のコスト | $10.00 | $20.00 |
キャッシュ料金は、Googleの95%ルール(2ドル x 0.05、4ドル x 0.05)から算出されています。Googleは入力コンテキストウィンドウやモデルIDを公開していません。出力制限は「以前の64Kトークンから増加し」100万トークンであると述べていますが、少なくともVals AIのようなサードパーティの評価者によれば、テストした構成での最大出力は262Kです。
Argon vs 現在のフロンティアモデルとGeminiモデル
すべての料金は100万トークンあたりです。
| モデル | 入力 | キャッシュされた入力 | 出力 | 最大出力 |
|---|---|---|---|---|
| Gemini 4 Argon (導入期間) | $2 | $0.10 | $10 | 1M |
| Gemini 4 Argon (標準) | $4 | $0.20 | $20 | 1M |
| GPT-6 Astra | $10 | $1 | $50 | 128,000 |
| Claude Opus 5.5 | $4 | $0.20 | $20 | 128K (Batchで300K、ベータ) |
| Claude Sonnet 5.5 | $2 | $0.20 | $10 | 128K (Batchで300K、ベータ) |
| GPT-6.1 Sol | $2 | $0.10 | $10 | 128,000 |
| Claude Fable 5.1 | $10 | $0.25 | $50 | 128K |
| gemini-3.1-pro-preview (プロンプト <=200K / >200K) | $2 / $4 | $0.20 / $0.40 | $12 / $18 | 65,536 |
| gemini-3.8-flash (導入期間 / 2027-01-01以降) | $0.75 / $1.50 | $0.075 / $0.15 | $3.75 / $7.50 | 65,536 |
競合モデルの料金は、各ベンダーのページから引用されています。OpenAIのGPT-6 Astraページ、Anthropicの料金ページ、GoogleのGemini API料金ページ。
- 標準Argon = Claude Opus 5.5。同じ$4/$20、同じキャッシュ入力$0.20。
- 導入期間中のArgon = Claude Sonnet 5.5 および GPT-6.1 Sol。同じ$2/$10。導入期間中のキャッシュ料金$0.10はGPT-6.1 Solと一致。
- GPT-6 AstraとClaude Fable 5.1は、導入期間中のArgonの5倍、標準Argonの2.5倍の費用がかかります。Claude Fable 5.1の料金を参照してください。
- Argonの導入期間中の出力料金($10)は、Googleの以前のトップProモデルであるgemini-3.1-pro-preview($12)を下回ります。
- 長いプロンプトは計算を変えます。OpenAIは272K入力トークンを超えるプロンプトについて、入力とキャッシュで2倍、出力で1.5倍の料金を請求します。Gemini 3.1 Proは200Kを超えると追加料金がかかりますが、Anthropicはかかりません。GoogleはArgonに長いプロンプトの階層があるかどうかをまだ発表していません。
価格と機能の比較については、Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5を参照してください。
思考トークンは出力として課金される
現在のGeminiモデルでは、思考トークンは出力として課金されます。Googleの思考に関するドキュメントには、「応答料金は出力トークンと思考トークンの合計である」と記載されています。GoogleはArgonについて具体的に文書化していませんが、同じルールが適用されると想定してください。GoogleはArgonの評価を「最高の思考設定で」実行したと述べているため、「100万出力トークンあたり10ドル」は回答と推論の合計と解釈してください。
4つのシナリオ
以下の数値はすべて、トークン数を100万で割り、100万トークンあたりのレートを掛けたものです。シナリオ1~3はキャッシングなしを想定しています。
1. 一般的なAPI呼び出し:20K入力、5K出力
- 導入期間:20,000 / 100万 x $2 = $0.04(入力)、プラス 5,000 / 100万 x $10 = $0.05(出力)。合計$0.09。
- 標準:$0.08 + $0.10 = $0.18。
1日1,000回の呼び出しの場合、導入期間中は90ドル、標準では180ドルになります。同じ呼び出しはClaude Opus 5.5では$0.18、GPT-6 Astraでは$0.45($0.20 + $0.25)、gemini-3.1-pro-previewでは$0.10($0.04 + $0.06)、gemini-3.8-flashの導入期間中の料金では約$0.034($0.015 + $0.019)です。
2. 長いエージェントターン:200K入力、50K出力
- 導入期間:200,000 / 100万 x $2 = $0.40、プラス 50,000 / 100万 x $10 = $0.50。合計$0.90。
- 標準:$0.80 + $1.00 = $1.80。
GPT-6 Astraは$4.50($2.00 + $2.50)を請求します。gemini-3.1-pro-previewは$1.00($0.40 + $0.60)を請求しますが、200Kはその階層の境界線です。より長いプロンプトは$4/$18で課金されます。Argonにも同様の階層がある場合、より長いターンはより費用がかかります。
3. 1回の最大出力応答:100万トークンの出力
出力のみの場合、導入期間中は1,000,000 / 100万 x $10 = $10.00、標準では$20.00です。100Kトークンのプロンプト(導入期間中$0.20、標準$0.40)を追加すると、呼び出し料金は$10.20または$20.40になります。
この表の他のどのモデルも、1回の同期応答でこれだけの出力を生成することはできません。競合モデルは128K、以前のGemini Proは65,536で上限が設定されています。Valsがリストしている262Kの最大出力の場合、完全な応答の費用は導入期間中で約$2.62、標準で$5.24です。エンジニアリング面(タイムアウト、ストリーミング、ゲートウェイ)については、Gemini 4 Argonの100万出力トークンで説明されています。
4. 10回再利用されるキャッシュされた500Kトークンプロンプト
同じ500Kトークンのコードベースまたは契約セットを10回送信し、それぞれ5Kトークンの出力がある場合を考えます。最初の呼び出しでキャッシュを構築するために全入力料金を支払い、その後の9回はキャッシュから読み取ると仮定します。
| 10回の呼び出し、500Kプロンプト、各5K出力 | 導入期間 | 標準 |
|---|---|---|
| 入力、キャッシュなし(10 x 500K) | $10.00 | $20.00 |
| 入力、キャッシュあり(1回フル + 9回キャッシュ) | $1.00 + 9 x $0.05 = $1.45 | $2.00 + 9 x $0.10 = $2.90 |
| 出力(10 x 5K) | $0.50 | $1.00 |
| キャッシングを含む合計 | $1.95 | $3.90 |
| キャッシングなしの合計 | $10.50 | $21.00 |
キャッシングにより、入力料金は85.5%削減されます。2つの注意点があります。GoogleはArgonがキャッシュストレージに対して課金するかどうか(gemini-3.1-pro-previewは100万トークンあたり1時間あたり4.50ドルを課金するため、500Kトークンを1時間保持するには2.25ドルが追加されます)をまだ発表しておらず、500Kのプロンプトは3.1 Proの200Kのラインを超えています。Argonの標準キャッシュ料金はOpus 5.5の$0.20と一致するため、Claude Opus 5.5プロンプトキャッシングコスト計算の損益分岐点ロジックが引き継がれます。
トークンあたりの価格はタスクあたりのコストではない
Artificial Analysisは、Gemini 4 Argon (High) のIntelligence Indexを実行するためのタスクあたり$1.99(導入期間中の価格)をリストしています。The Decoderは、同じ実行が標準価格で$3.98になると述べています。AAはArgonのスコアを53としており、これはGPT-6 Astra(最大)と同じで、Astraのタスクあたり$3.26とリストされています。
問題はトークン量です。AAは、Argon(high)のタスクあたり約62Kの出力トークンに対し、最大設定のAstraでは約27Kと、約2.3倍の出力トークン数を計上しています。導入期間中のタスクあたりの出力:62,000 / 100万 x $10 = $0.62に対し、Astraでは27,000 / 100万 x $50 = $1.35です。標準では、The DecoderのArgonのタスク全体の数値($3.98)は、Argonの標準料金がAstraの60%以下であるにもかかわらず、AAのAstra(最大)の$3.26を上回ります。
Vals AIも同じパターンを示しています。Vals IndexでのArgonのテストあたり$15.68に対し、Claude Opus 5.5は$32.14、Claude Sonnet 5.5は$21.34、GPT-6.1 Solは$3.24とリストされており、Argonは$4/$20の標準料金でリストされています。Sonnet 5.5とGPT-6.1 SolはArgonの導入期間中の料金を名目上共有していますが、テストあたりのコストは6倍以上も離れています。
料金表ではなく、自身のトークン数から予算を立ててください。
Argonリリース前に設定すべきコスト管理
- 出力を上限設定する。generateContentでは、
generationConfig.maxOutputTokensが上限を設定します。Googleによると、新しいモデルはInteractions APIで起動されるため、Argonのドキュメントに記載されたら、そこでも同等の上限を設定してください。標準料金では、100万の上限は呼び出しあたり20ドルの出力上限となります。 - 安定したコンテンツをキャッシュする。呼び出し間で繰り返されるシステム指示、スキーマ、参照ドキュメントは、95%割引が効果を発揮する場所です。
- 思考レベルを意図的に選択する。GoogleはArgonのレベルを公開していません。現在、gemini-3.1-pro-previewは
highがデフォルトで、gemini-3.8-flashはmediumです。Argonのドキュメントが公開されたら、より低いレベルでもタスクの品質が維持できるかテストしてください。 - 使用量に関するアサーションを設定する。すべてのgenerateContent応答は
usageMetadataで終わります。Apidogで、モデルをGEMINI_MODEL環境変数としてリクエストを保存し、usageMetadataのトークン数からコストを計算する応答後アサーションを追加して、呼び出しが上限を超えたときにテストを失敗させてください。今日、gemini-3.8-flashに対してこれを実行し、ArgonのモデルIDがリリースされたら、1つの変数を変更してスイートを再実行してください。
そのアサーションの計算式:
コスト = キャッシュされていない入力 / 1,000,000 x 入力レート
+ キャッシュされた入力 / 1,000,000 x キャッシュレート
+ (出力 + 思考) / 1,000,000 x 出力レート
Googleがまだ価格設定していないもの
導入期間の長さと$4/$20が始まる日付。200Kを超えるプロンプトがより高価になるかどうか。BatchまたはFlexの料金(3.1 Proには両方あり、入力$1/$2、出力$6/$9)。キャッシュストレージ料金。レート制限。そして、無料枠がそもそも存在するのか。
よくある質問
Gemini 4 Argonは100万トークンあたりいくらかかりますか? 導入期間中は入力2ドル、出力10ドルで、その後は4ドルと20ドルです。キャッシュされた入力は95%オフで、0.10ドル、その後は0.20ドルです。
導入期間中の料金はいつまで続きますか? Googleはまだ発表していません。発表投稿には終了日や期間の記載がありません。
思考トークンは出力として課金されますか? 現在のGeminiモデルではそうです。GoogleはArgonのルールを具体的に文書化していません。
100万トークンの出力応答はいくらかかりますか? 導入期間中の料金では10ドル、標準料金では20ドルで、入力料金は含まれません。
ArgonはClaude Opus 5.5やGPT-6 Astraよりも安いですか? トークンあたりでは、標準ArgonはOpus 5.5と同等で、Astraより60%安いです。タスクあたりでは、トークン量によります。Artificial Analysisによると、ArgonはAstraの出力トークンの約2.3倍を使用しました。より安価なGeminiを今すぐ利用するには、Gemini 3.8 Flashの料金を参照してください。
Argonは今日から支払って利用できますか? いいえ。Fairwind Programのパートナーのみに展開されています。有料API顧客とGoogle AI Ultraのサブスクライバーはその後ですが、日付は未定です。
今すぐ予算を立て、後で測定する
現在のトラフィックのトークン数を$2/$10と$4/$20で掛ければ、Argonの導入期間中と標準の料金範囲が分かります。次に測定を構築します。Apidogをダウンロードし、GEMINI_MODELを変数としてgemini-3.8-flashに対するリクエストを保存し、usageMetadataに対するコストアサーションを追加します。GoogleがモデルIDを公開したら、1つの値を変更して、初日から実際の呼び出しあたりのコストを確認できます。
