Googleは、3.6 Flashから3週間後の2026年8月13日にGemini 3.7 Flashを出荷しました。これはGemini 3.5 Proの遅延が続く中でのリリースとなります。同社はこれを「当社の最もインテリジェントな主力モデル」と呼んでおり、公式発表では、コーディングおよびエージェントタスクでベンチマークが10~16ポイント向上したことで、その主張を裏付けています。Gemini APIを使用して開発するなら、今後数ヶ月間はこのモデルを使うことになるでしょう。
このページはリファレンスカードです。すべての仕様、価格、ベンチマークの差分、およびアクセスチャネルが、1分以内に読み取れるテーブル形式で一箇所にまとめられています。コードを記述する準備ができたら、Gemini 3.7 Flash APIクイックスタートがcURL、Python、Nodeでの手順をステップバイステップで説明し、Apidogは、コードが存在する前にエンドポイントに対してテストリクエストを実行するためのワークスペースを提供します。
このページはブックマークしておいてください。以下の数値は2027年1月1日に、導入価格期間が終了すると変更されますが、当社はテーブルを常に最新の状態に保ちます。
TL;DR
- モデルIDは
gemini-3.7-flashで、2026年8月13日現在、Gemini APIで利用可能。160以上の国で提供されています。 - スペック:1Mトークンの入力コンテキスト、64kトークンの出力制限、マルチモーダル入力(テキスト、画像、動画、音声、PDF)、テキスト出力。
- ツール:関数呼び出し、ツールとしての検索、コンピューターの使用がすべてサポートされています。
- 導入価格:2026年12月31日まで、入力1Mトークンあたり$0.75、出力1Mトークンあたり$3.75。2027年1月1日からは、標準料金は$1.50と$7.50に倍増します。
- 3.6 Flashからのベンチマーク向上:DeepSWE v1.1が49.0%から65.3%へ、AutomationBenchが17.0%から30.4%へ、WebDev Arena Eloが1538から1588へ。
- Gemini API、Google AI Studio、Geminiアプリ、Gemini Spark、Google Antigravity、Android Studio、およびGemini Enterpriseを通じてアクセスできます。
Gemini 3.7 Flash スペックシート
GoogleのGemini Flashモデルページおよび発表資料からの主要な数値です。
| スペック | 値 |
|---|---|
| モデルID | gemini-3.7-flash |
| リリース日 | 2026年8月13日 |
| 入力コンテキストウィンドウ | 1,000,000トークン |
| 出力トークン制限 | 64,000トークン |
| 入力モダリティ | テキスト、画像、動画、音声、PDF |
| 出力モダリティ | テキスト |
| 関数呼び出し | はい |
| ツールとしての検索 | はい |
| コンピューターの使用 | はい |
| 長文コンテキスト検索 (128k針) | 97.0% |
| 安全性 | CBRNおよびサイバーセーフガードを更新 |
| 利用可能地域 | 160以上の国 |
| APIエンドポイント | generativelanguage.googleapis.com (AI Studioキー) または aiplatform.googleapis.com (Vertex, OAuth) |
2つの項目に注目すべきです。64kの出力制限はFlashクラスのモデルとしては寛大で、ファイル全体の書き換えや長い構造化出力が1つの応答に収まることを意味します。また、コンピューターの使用サポートは、3.7 Flashをブラウザを直接操作できる数少ないモデルのグループに入れますが、ほとんどのプロダクション自動化では、構造化されたAPI呼び出しの方が依然として優れています。トレードオフについては、コンピューターの使用 vs 構造化APIで説明されています。
料金の概要
Googleは3.7 Flashを3.6 Flashの半額で提供開始しましたが、この割引には有効期限があります。
| 層 | 入力 (1Mトークンあたり) | 出力 (1Mトークンあたり) | 有効期間 |
|---|---|---|---|
| 導入価格 | $0.75 | $3.75 | 2026年12月31日まで |
| 標準価格 | $1.50 | $7.50 | 2027年1月1日から |
元旦には、両方の料金がきれいさっぱり2倍に跳ね上がります。もしあなたのワークロードがトークンを大量に消費するものであれば、導入期間はベンチマークを行い、プロンプトを調整し、キャッシュ戦略を確立するのに最適な時期です。間違いのコストが半分で済むうちにこれらを行うことができます。具体的なコスト例、実際のワークロードでのトークン計算、そして標準料金が適用される前に費用を削減する戦略については、Gemini 3.7 Flashの料金説明をご覧ください。料金に関する最新の情報源は、Gemini API料金ページです。
ベンチマーク:3.6 Flash vs 3.7 Flash
Googleは、3.6 Flashからのコーディング、Web開発、ドキュメント理解、エージェント自動化におけるデルタを公開しました。前身モデルから3週間後にリリースされたポイントリリースとしては、その差は大きく、9to5Googleのリリース報道でも指摘されています。
| ベンチマーク | Gemini 3.6 Flash | Gemini 3.7 Flash | 差分 |
|---|---|---|---|
| DeepSWE v1.1 (エージェントコーディング) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Main | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (ドキュメント理解) | 22.0% | 34.0% | +12.0 |
| AutomationBench (エージェント自動化) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (法律) | n/a | 90.7% | n/a |
| 128k-針検索 | n/a | 97.0% | n/a |
この表全体に見られるパターンとして、エージェントワークロードが最も向上しています。Googleが述べている改善点は一致しており、デバッグの向上、より展開可能な初回コード、多段階の計画とツール呼び出しに対するより綿密な思考、そしてより厳密な指示追従が挙げられます。これらの数値がAnthropicやOpenAIのモデルとどう比較されるかは別の問題であり、Gemini 3.7 Flash vs Claude vs GPTで回答されています。
Gemini 3.7 Flashの利用場所
リリース時には7つのアクセスチャネルがあります。役割に応じて選択してください。
| チャネル | 用途 | 対象ユーザー |
|---|---|---|
| Gemini API | AI Studioキーを使用したプログラムによるアクセス | アプリケーションを出荷する開発者 |
| Google AI Studio | ブラウザプレイグラウンド、プロンプトの反復、キー管理 | プロトタイプを開発する開発者 |
| Gemini アプリ | Webおよびモバイルでの消費者向けチャット | エンドユーザー |
| Gemini Spark | エージェントコーディング環境 | AI ProおよびUltraサブスクライバー |
| Google Antigravity | エージェントファースト開発プラットフォーム | 自律型エージェントを構築するチーム |
| Android Studio | Android作業のためのIDE統合 | モバイル開発者 |
| Gemini Enterprise | 管理者制御付きのマネージドデプロイメント | 企業IT部門 |
API作業の場合、AI Studioキーパスを使えば数分で動作するリクエストを作成できます。Vertex AIは、本番環境の制御が必要な場合に、OAuth、IAM、監査ログ、およびリージョンエンドポイントの背後で同じモデルを提供します。
最小限の動作するリクエスト
AI Studioからキーを取得し、エクスポートして、1つのリクエストを送信します。
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
ストリーミングの場合、同じパスでメソッドを:streamGenerateContent?alt=sseに切り替えます。応答は、テキスト部分を含むcandidates配列と、課金対象となるトークン数を含むusageMetadataブロックを返します。
ターミナルで手動でJSONを編集したくない場合は、ApidogがGenerative Language APIの仕様をインポートし、GEMINI_API_KEYをx-goog-api-keyヘッダーの環境変数としてバインドし、SSEストリームをリアルタイムでレンダリングします。良い応答を一度例として保存すれば、有料エンドポイントではなくそのフィクスチャに対してテストを再実行できます。
レート制限とティア
Googleはモデルごと、ティアごと(無料、従量課金、プロビジョニングレベル)にレート制限を設定しており、その数値は頻繁に変わるため、ここに記載された表はすぐに古くなってしまいます。公式のGemini APIドキュメントで、gemini-3.7-flashの現在の1分あたりのリクエスト数と1分あたりのトークン数の上限を確認してください。
安定した経験則が2つあります。AI Studioを通じた無料ティアのクォータはプロトタイプ作成には十分ですが、出荷には足りません。そして、ステータスRESOURCE_EXHAUSTEDを示す429エラーは、1分または1日あたりの上限に達したことを意味します。ジッターを伴ってバックオフするか、可能な場所でバッチ処理を行うか、プロジェクトを有料ティアに移行してください。
クイックリンク
- 公式発表:Googleの主張とベンチマークチャートを含む発表記事
- Gemini APIドキュメント:エンドポイントリファレンス、SDKガイド、レート制限
- 料金ページ:リアルタイムのトークンあたり料金
- モデルページ:スペックとモダリティの詳細
- APIキーの取得:AI Studioキーを2クリックで入手
FAQ
Gemini 3.7 Flashのスペックを一言で言うと?
1Mトークンの入力コンテキストウィンドウ、64kトークンの出力制限、テキスト、画像、動画、音声、PDFにわたるマルチモーダル入力、テキスト出力、そして関数呼び出し、ツールとしての検索、コンピューターの使用のサポートを備え、Gemini APIを通じてgemini-3.7-flashとしてアドレス指定可能です。
Gemini 3.7 Flashの料金はいくらですか?
2026年12月31日まで、入力1Mトークンあたり$0.75、出力1Mトークンあたり$3.75です。2027年1月1日からは、標準料金が適用され、入力$1.50、出力$7.50となります。導入料金は3.6 Flashがリリースされたときの半額です。
3.6 Flashからアップグレードするためにコードを変更する必要がありますか?
交換自体は1行だけです。モデルIDをgemini-3.7-flashに変更します。3.7は多段階のツール呼び出しについてより長く考え、指示をより厳密に遵守するため、動作変更が実際の作業となります。3.6から3.7 Flashへの移行ガイドでは、トラフィックを切り替える前に回帰テストすべきことについて説明しています。
GoogleはなぜGemini 3.5 Proよりも先に3.7 Flashを出荷したのですか?
Gemini 3.5 Proはまだ遅延しており、Axiosは、Googleが次期フラッグシップモデルの改善を待たずにFlashアップデートを先行出荷していると報じました。3.6と3.7 Flashの間が3週間という間隔は、そのペースに合致します。
無料で試す方法はありますか?
はい。AI Studioの無料ティアには、プロンプトのテストや小規模なプロトタイプ作成に十分なgemini-3.7-flashの1日あたりのクォータが含まれており、より高いレート制限が必要になるまで課金アカウントは不要です。Gemini APIの無料アクセスガイドでは、無料ティアがどの程度まで使えるか、上限に達したときにどうすべきかについて説明しています。
3.7 Flashがあなたのスタックにどのように適合するか
3.7 Flashは、エージェントループ、コーディングアシスタント、ドキュメントパイプライン、そしてセッションあたり多くのツール呼び出しを行うあらゆるものにとって、デフォルトのGeminiモデルとして扱ってください。ベンチマークの向上はまさにこれらのワークロードに集中しており、導入価格により、今後4か月半が最も安価な開発期間となります。Gemini 3.5 Proが出荷されるまではフラッグシップクラスの推論については判断を保留し、それ以外のすべてについては、Googleが言うとおりの主力モデルです。
モデルIDが本番コードに投入される前に、エンドポイントをテストしてください。Apidogをダウンロードして、Geminiのリクエスト、環境、ストリーミングチェック、保存された応答フィクスチャを、評価中の他のすべてのプロバイダーのコレクションとともに、1つのワークスペースに保持しましょう。
