Gemini 3.7 Flashは、Googleの最新の主力AIモデルで、Gemini 3.6 Flashの3週間後の2026年8月13日にリリースされました。前身の1Mトークンのコンテキストウィンドウとマルチモーダル入力は維持しつつ、コーディングとエージェントのベンチマークで大幅な向上を達成しています。APIの導入価格は100万入力トークンあたり0.75ドルです。Googleはこれを「当社の最もインテリジェントな主力モデル」と呼んでいます。
リリースの3週間という短い間隔が注目すべき点です。GoogleはFlashのアップデートをスプリント形式で提供している一方で、Gemini 3.5 Proは依然として遅延しており、これはミッドティアモデルが最初に興味深いエンジニアリングが投入される場所になっていることを意味します。ベンチマークの差がそれを裏付けています。DeepSWEは16ポイント上昇し、AutomationBenchはほぼ倍増、そして導入価格は3.6 Flashのローンチ価格の半分に抑えられています。
この記事では、変更されたすべての点について解説します。Googleが発表全体に散りばめた完全なベンチマーク表、カレンダーに記入すべき価格期間、今日モデルにアクセスできるすべての場所、そして5分で実行できる動作するcURLリクエストです。より詳細なエンドポイントのウォークスルーが必要な場合は、Gemini 3.7 Flash APIクイックスタートがこの解説と対になっており、Apidogは、切り替えを決定する前に既存のプロンプトに対して新しいモデルをテストするためのワークスペースを提供します。
TL;DR
- Gemini 3.7 Flashは、3.6 Flashの3週間後の2026年8月13日にリリースされました。モデルID:
gemini-3.7-flash。 - コーディングおよびエージェントのベンチマークが飛躍的に向上しました。DeepSWE v1.1が49.0%から65.3%へ、AutomationBenchが17.0%から30.4%へ、WebDev Arena Eloが1538から1588へ。
- APIの導入価格は100万入力トークンあたり0.75ドル、100万出力トークンあたり3.75ドルで、3.6 Flashのローンチ価格の半分です。標準料金(1.50ドル/7.50ドル)は2027年1月1日に開始されます。
- 仕様は据え置きです。1Mトークンの入力コンテキスト、64kの出力制限、マルチモーダル入力(テキスト、画像、動画、音声、PDF)、関数呼び出し、ツールとしての検索、コンピューターの使用。
- 現在、Gemini API、AI Studio、Geminiアプリ、Gemini Spark、Google Antigravity、Android Studio、Gemini Enterpriseで、160以上の国で利用可能です。
- Gemini 3.5 Proは依然として遅延しており、Googleは次期フラッグシップに先駆けてFlashの改善を提供しています。
Gemini 3.7 Flashとは
Flashは、Geminiラインのミドルティアモデルです。Proよりも安価で高速、Flash-Liteよりもスマートで、ほとんどのプロダクションAIトラフィックを構成する大容量ワークロード向けに調整されています。Gemini 3.7 Flashは3.xラインで3番目のFlashリリースであり、Googleのフレームワークもそれに伴い変化しました。公式発表では、まずコーディングおよびエージェントモデルとして、次にチャットモデルとして位置づけられています。

スペックシートは3.6 Flashから引き継がれています。
- コンテキスト:1Mトークンの入力ウィンドウ、64kトークンの出力制限。
- 入力モダリティ:テキスト、画像、動画、音声、PDF。出力はテキストのみ。
- ツール機能:関数呼び出し、ツールとしての検索、コンピューターの使用。
- 安全性:CBRNおよびサイバー保護がアップデートされ、リリースと同時に提供されます。
変更されたのはアーキテクチャではなく、動作です。Googleは、3.7 Flashがより優れたデバッグ能力を持ち、一度で展開可能なプロダクション対応コードをより頻繁に生成し、障害に遭遇した際に適応し、意図が曖昧な場合に明確化の質問を投げかけ、より高い忠実度で指示に従うと述べています。これらは主張であり、以下のベンチマークがその証拠です。
ベンチマークの改善点:3.6対3.7
Googleはこれらの数値をブログ記事とモデルカードに分散させて掲載しました。ここでは、重要な差分とともに1つの表にまとめています。
| ベンチマーク | Gemini 3.6 Flash | Gemini 3.7 Flash | 変更 |
|---|---|---|---|
| DeepSWE v1.1 (エージェント的コーディング) | 49.0% | 65.3% | +16.3 pts |
| FrontierCode 1.1 Main | 34.4% | 43.6% | +9.2 pts |
| WebDev Arena (Elo) | 1538 | 1588 | +50 Elo |
| GDP.pdf (文書推論) | 22.0% | 34.0% | +12.0 pts |
| AutomationBench (エージェントタスク) | 17.0% | 30.4% | +13.4 pts |
2つの単独スコアが全体像を補完します。法律推論ベンチマークであるHarvey LAB-AAで90.7%、128k-needleの長文コンテキスト検索で97.0%です。2つ目の数値は、モデルに長文を供給する場合に重要です。多くのモデルは、深いレベルでの検索品質が静かに破綻します。
この表全体で一貫したパターンが見られます。最大の飛躍はエージェントベンチマーク、つまり単一の回答ではなく多段階の作業を測定するベンチマークで起こっています。AutomationBenchが17.0%から30.4%に上昇したことは、ミッドティアモデルに任せられるタスクの種類を大きく変えるほどの差分です。リリースの報道では、DeepSWEの向上を主要な結果として取り上げていますが、それには十分な理由があります。3週間でエージェント的コーディングが16ポイントも上昇するのは、どのようなモデルラインにとっても異例です。ベンチマークの差分が競合モデル間でどのように変換されるかの文脈については、Grok 4.6対GPT 5.6対Claudeの比較で、同様のギャップが実際のワークロードでどのように現れるかを示しています。
コーディングとエージェントの改善
ベンチマーク表は改善された点を示しています。Googleのリリースノートは、それが実際にどのように現れるかを具体的に示しており、その主張はテストするのに十分な具体性を持っています。
- デバッグ。モデルは症状を一時的に修正するのではなく、障害の原因を特定する能力が向上しました。DeepSWEの向上は、このベンチマークが実際のレポジトリでの複数ファイルのバグ修正を評価するため、これを裏付ける数値です。
- 一度で展開可能なコード。Googleは、生成されたコードが修正なしでより多く実行されると主張しています。FrontierCodeの9.2ポイントの改善が、最も近い公開された測定値です。
- 障害処理。ツール呼び出しが失敗したり、ファイルが見つからない場合、3.7 Flashはループせずに計画を適応させます。これはAutomationBenchが重点を置く動作です。
- 意図の明確化。リクエストが曖昧な場合、モデルは推測するのではなく質問をします。エージェントのパイプラインでは、1回の明確化のターンは、間違った5,000トークンの回答よりも安価です。
- 指示の忠実度。出力形式の要求、長さの制限、および否定的な制約が、長時間の会話全体でより確実に維持されます。
ツールスタックは、純粋なスコアと同じくらい重要です。関数呼び出しとツールとしての検索は3.6から引き継がれており、コンピューター使用のサポートにより、タスクのAPIが存在しない場合でもモデルがブラウザを操作できるようになります。最後の機能は開発者にとって奇妙な位置づけです。強力ですが、構造化されたエンドポイントよりも遅く、非決定的です。コンピューターの使用と構造化APIの比較では、それぞれのアプローチがいつ役立つかを解説しています。
価格:2026年12月31日まで半額
Gemini 3.7 Flashは、Gemini APIで2段階の価格スケジュールでリリースされます。
| 期間 | 入力 (100万トークンあたり) | 出力 (100万トークンあたり) |
|---|---|---|
| 2026年12月31日まで | $0.75 | $3.75 |
| 2027年1月1日から | $1.50 | $7.50 |
導入レートは、Gemini 3.6 Flashのリリース時の半額であり、今後4か月半がこのモデルファミリーで最も安価な期間となります。ただし、1月1日には料金が倍になるという注意点があります。もし0.75ドルの入力トークンで予算を組んでいる場合、今から計画しないと5ヶ月で予算が破綻することになります。
実用的な2つのポイントがあります。まず、何かをリリースする前に公式料金ページで現在の料金を確認してください。導入期間はこれまでも変更されてきました。次に、2027年のコストはプロモーションレートではなく、標準レートで見積もってください。チャットボット、ドキュメントパイプライン、エージェントループのトークン計算を含む完全な例は、Gemini 3.7 Flashの価格解説に記載されています。
今日利用可能な場所
Googleは、3.7 Flashを初日から160カ国以上で全面展開しています。
- Gemini API。開発者向けのパスです。AI Studioからキーを取得し、
gemini-3.7-flashを直接呼び出します。 - Google AI Studio。コードを書く前にプロンプトをテストするためのブラウザプレイグラウンドです。
- Geminiアプリ。コンシューマー向けチャットアプリはリリース時に新しいモデルを搭載しました。
- Gemini Spark。AI ProおよびUltra加入者が利用可能です。
- Google Antigravity。Googleのエージェント開発環境がこれをベースに動作します。
- Android Studio。IDE統合により、コードアシスタンスにモデルが利用可能になります。
- Gemini Enterprise。コンプライアンス要件を持つ組織向けのマネージドサービスです。
大規模なAPIアクセスには、OAuth、IAM、監査ログを備えたaiplatform.googleapis.com上のVertex AIパスも利用できます。同じモデル、同じリクエストスキーマですが、認証とホスティングの保証が異なります。
GoogleがGemini 3.5 Proよりも先にFlashをリリースした理由
リリース順序は異例です。通常、フラッグシップモデルが先行し、安価なティアがそれに続きます。Googleはこれを逆転させました。3.6 Flashが7月下旬に、3.7 Flashが3週間後にリリースされ、Gemini 3.5 Proはまだ日程が未定です。Axiosの報道によると、Googleは次期フラッグシップが遅延している間、意図的にFlashのアップデートを先行させています。
スケジュール遅延ではなく戦略として捉えると、この動きは理にかなっています。ほとんどのプロダクションのトラフィックはミドルティアモデルで実行されます。なぜなら、そこではトークンあたりのコストが許容可能な品質と合致するからです。Flashを改善することは、ほとんどの顧客が毎日触れるモデルを改善することになります。また、主要なラボが急速にリリースを行う時期に、フラッグシップの発表を犠牲にすることなく、Googleをリリースサイクルに関する会話に留まらせる効果もあります。
開発者にとっての実用的な結果として、Flashティアはもはや後発ではありません。エージェント機能がここに最初に投入されています。もしProを待っているため3.6からワークロードを移行するのを躊躇していたなら、3.6から3.7 Flashへの移行ガイドがその切り替えについて解説しています。ほとんどのコードベースでは、これはモデルIDを1行変更し、リグレッションテストを行うだけです。
5分でAPIを試す方法
AI StudioからAPIキーが必要です。キーを作成し、エクスポートして、最初のリクエストを送信します。
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "Review this function for bugs: def dedupe(items): return list(set(items))" }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
応答はcandidates配列として返され、生成されたテキストはcontent.partsに、正確な入力および出力トークン数を報告するusageMetadataブロックが含まれます。このブロックは初日から監視してください。これはあなたのコストメーターです。ストリーミングの場合、:generateContentを:streamGenerateContent?alt=sseに置き換えると、APIはサーバー送信イベントを返します。
最初の呼び出しが成功したら、端末での実験をやめます。Apidogで、Generative Language APIの仕様をインポートし、GEMINI_API_KEYを環境変数としてx-goog-api-keyヘッダーにバインドし、モデルIDをパス変数として保存します。これで、gemini-3.6-flashとgemini-3.7-flashに対して同じプロンプトを並行して再実行し、SSEストリームがライブでレンダリングされるのを確認し、応答を例として保存できるため、回帰チェックでトークンを無駄にすることはありません。これは、ローンチポストの言葉を鵜呑みにするのではなく、Googleの「より良い指示追従」の主張を自分のプロンプトで検証する最も速い方法です。
よくある質問
Gemini 3.7 Flashは無料で利用できますか?
Gemini APIは、AI Studioを通じて日次クォータ付きの無料枠を提供しており、プロトタイピングをカバーします。有料利用は、2026年12月31日まで、100万入力トークンあたり0.75ドルの導入レートで始まります。無料クォータをさらに活用したい場合は、無料のGemini APIアクセスガイドで制限と利用方法を解説しています。
Gemini 3.6 Flashと3.7 Flashの違いは何ですか?
スペックは同じですが、動作が改善されました。コンテキストウィンドウ、出力制限、モダリティ、ツールサポートは変更されていません。向上したのはコーディングとエージェントのベンチマークで、DeepSWEが16.3ポイント、AutomationBenchが13.4ポイント、WebDev Arenaが50 Elo上昇しました。Googleはまた、デバッグ能力、指示追従性、多段階計画の改善も主張しています。
Gemini 3.7 FlashはGemini 3.5 Proを置き換えますか?
いいえ。Proは最も困難な推論タスク向けのフラッグシップティアであり、Gemini 3.5 Proは現在も開発中です。Flash 3.7は、品質と同じくらいコストとレイテンシが重要な大量のプロダクション作業にGoogleが推奨するモデルです。
2027年1月1日には価格はどうなりますか?
導入レートが終了し、標準価格に移行します。100万入力トークンあたり1.50ドル、100万出力トークンあたり7.50ドルで、リリース時の料金の2倍になります。2026年以降も存続するワークロードについては、標準レートで予算を組んでください。
Gemini 3.7 Flashは画像とPDFを処理できますか?
はい。入力モダリティは、テキスト、画像、動画、音声、PDFを同じcontents配列でカバーします。出力はテキストのみです。GDP.pdfベンチマークスコアが22.0%から34.0%に上昇したことは、コーディングの向上と並行して文書理解が改善されたというGoogleの証拠です。
3.7 Flashがあなたのスタックに適合する場所
Gemini 3.7 Flashは、エージェントティアのベンチマークスコアを持ち、4ヶ月間の割引価格が設定されたミッドティアモデルです。この組み合わせにより、評価するかどうかではなく、どれだけ早く評価するかが問題になります。エージェント的な向上は公開ベンチマークの実際の数値であり、スペックは現在3.6で実行しているものと一致し、導入価格は、今テストすれば1月に同じ評価を行うコストの半分で済むことを意味します。
合理的な手順は次のとおりです。既存のプロンプトスイートをgemini-3.7-flashに対して実行し、現在のモデルと比較して出力とトークンの使用量を比較し、結果によって勝者を選びます。Apidogをダウンロードして、その比較を1つのワークスペースで実行してください。3.6の応答を例として保存し、同じリクエストを3.7に対して再生すれば、午後にはベンチマークの主張があなたのワークロードに当てはまるかどうかを知ることができます。
ボタン
