Gemini 3.8 Flashは2026年9月2日にリリースされ、今年の最先端のローンチの多くとは異なり、実際に無料で利用できる経路が提供されています。Google AI Studioで無料でチャットしたり、約1分で作成できるキーを使って無料枠のGemini APIから呼び出したりできます。Googleの発表記事では「当社の最もインテリジェントなFlashモデル」とされており、無料枠でも、有料顧客が使用するのと同じモデルID(gemini-3.8-flash)が提供され、機能削減版ではありません。
しかし、3つの注意点があり、このガイドではそれらすべてを解説します。無料枠にはレート制限があります。Googleは、無料枠のデータが製品改善のために使用されると述べています。そして、Geminiアプリの無料プランには3.8 Flashは含まれていません。それにはGoogle AI ProまたはUltraのサブスクリプションが必要です。まずは詳細な仕様を知りたい場合は、Gemini 3.8 Flashとは何かから始めてください。今後5分以内にリクエストを実行したい場合は、読み進めてください。
無料アクセスの概要
| サービス | 費用 | Gemini 3.8 Flashは含まれますか? | 注意事項 |
|---|---|---|---|
| Google AI Studio (ウェブプレイグラウンド) | $0 | はい | レート制限あり。データは製品改善のために使用されます。 |
| Gemini API 無料枠 | $0 | はい | AI Studioのレート制限ページに表示されている制限と同じです。 |
| Geminiアプリ、無料プラン | $0 | いいえ | 3.8 FlashにはGoogle AI ProまたはUltraが必要です。 |
| Google検索のAIモード | $0 | はい(一般ユーザー向け) | APIなし、思考レベルの制御なし。 |
| GoogleスプレッドシートのGemini | プランによる | はい(一般ユーザー向け) | APIなし。 |
| Google検索グラウンディング | 月5,000リクエスト無料 | Gemini 3.x全体で共有 | 以降は1,000リクエストあたり14ドル。 |
| バッチAPI | 有料料金の50%オフ | はい | 無料ではありません。最も安価な有料経路です。 |
| Gemini 3.8 Flash Cyber | 非売品 | いいえ | Fairwindプログラム限定。いかなる価格でも公開APIはありません。 |

ステップ1: AI Studioを開き、gemini-3.8-flashを選択する
Google AI Studioにアクセスし、Googleアカウントでサインインしてください。請求アカウントもクレジットカードも不要です。モデルピッカーでgemini-3.8-flashを選択します。これはプレビューサフィックスのない安定版IDです。実行設定には思考レベルが表示され、3.8 Flashではlow、medium、highの3つの値があります。デフォルトはMediumです。このモデルにはminimalはなく、API経由で送信すると、暗黙的なフォールバックではなくバリデーションエラーが発生します。思考レベルガイドでは、各レベルのトークンと時間あたりのコストについて説明しています。
無料利用においては、2つの設定が重要です。まず、temperatureはそのままにしておきます。Googleは、すべてのGemini 3モデルについて、デフォルトの1.0に保つよう推奨しています。値を下げると、ループや出力の劣化を引き起こす可能性があるためです。次に、探索中はlowから始めます。3.8 Flashは、複雑なタスクに対して「より懸命に」機能するように設計されており、より小さな推論ステップを実行し、ツールを繰り返し呼び出します。Googleは「設計上、より長時間の複雑なタスクでより多くのトークンを使用する可能性がある」と述べています。1分あたりのトークンで測定される層では、その消費量は3.7 Flashよりも早くクォータを使い果たします。lowに設定することで、実験費用を抑えることができます。
ステップ2: 無料APIキーを取得する
AI Studio内で、APIキーページを開き、新規または既存のプロジェクトでキーを作成します。このキーは無料で、無料枠に対してすぐに機能します。料金ページには、3.8 Flashの入力と出力がその層では「無料」と記載されており、有料料金も併記されています。まだ行ったことがない場合は、当社のGemini APIキーのチュートリアルにスクリーンショットがあります。
キーは環境変数として保存し、コードやシェル履歴に残さないようにしてください:
export GEMINI_API_KEY="paste-your-key-here"
キーはパスワードのように扱ってください。無料枠には請求が関連付けられていないため、キーが漏洩しても高額な請求が発生することはありませんが、あなたが使う前に日次クォータを使い切ってしまう可能性があります。
ステップ3: 初めての無料呼び出しを行う
Gemini 3.xは現在、主にInteractions APIで実行されます。1つのリクエストで、SDKは不要です:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
レスポンスは、テキストを含むmodel_outputステップで終わる、実行ステップ(モデルの思考、もしあればツール呼び出し)のリストです。既存のgenerateContentコードがある場合でも、引き続き機能します。Googleはこれをレガシーと呼んでいますが、サポート終了日はなく「完全にサポートされている」と述べており、そのエンドポイントではgenerationConfig.thinkingConfig.thinkingLevelがレベルを設定する場所になります。両方の形式、Pythonでの同等のもの、およびprevious_interaction_idを使用したマルチターンについては、Gemini 3.8 Flash APIガイドで説明されています。
429エラーが表示された場合、無料枠のレート制限に達しています。待つか、Tier 1について読み進めてください。
無料枠があなたにもたらすもの
金銭的なコストはありません。しかし、他に3つの注意点があります。
レート制限。 無料枠では、モデルごとに1分あたりのリクエスト数、1分あたりのトークン数、1日あたりのリクエスト数が制限されます。Googleは正確な数値をドキュメントテキストではなく、AI Studioレート制限ページでのみ公開しており、変更履歴なしで変更されることがあります。このブログを含む、ブログで読んだ数値を信頼するのではなく、そのページを確認してください。レート制限ドキュメントでは、各層がどのように積み重なるかについて説明しています。
あなたのデータ。 Googleは、無料枠のプロンプトと出力が製品改善のために使用されると述べています。これはベンチマークプロンプトや試作アプリには問題ありません。しかし、顧客記録、未公開のソースコード、NDA下のものには適していません。有料層には異なる条件が適用されます。機密性の高いリクエストを送信する前に、事後ではなく、請求をリンクしてください。
トークン消費量。 Artificial Analysisは、3.8 Flashをハイモードで使用した場合、インデックス上のタスクあたり約48kの出力トークンを消費すると測定しており、これは3.7 Flashよりも30%多い数値です。思考トークンは、表示される出力と同じ1分あたりのトークン制限に対してカウントされます。より高度な推論を行うモデルは、無料クォータをより速く消費します。これが、余裕のある有料プランに移行するまでlowまたはmediumをデフォルトに設定する実用的な理由です。
Geminiアプリは無料経路ではない
「Gemini 3.8 Flash 無料」という検索の多くがここで誤解を生みます。一般ユーザー向けには、3.8 FlashはGoogle AI ProおよびUltraのサブスクライバー向けのGeminiアプリで利用可能です。発表された情報によると、無料アプリプランでは利用できません。サブスクリプションなしでアプリを開いてFlashモデルが表示されたとしても、それは3.8ではありません。
追加料金なしで3.8 Flashを利用できる一般ユーザー向けのサービスは、Google検索のAIモードとGoogleスプレッドシートのGeminiです。どちらもその回答を読むのに役立ちます。しかし、どちらも思考レベルの制御、トークン数、またはAPIを提供しないため、開発と呼べるようなことには、AI Studioと無料API層が真の無料経路となります。
無料グラウンディング: 月5,000回のGoogle検索リクエスト
モデルが現在のウェブ検索結果を回答に組み込めるGoogle検索グラウンディングは、すべてのGemini 3.xモデルで共有される月5,000件の無料リクエストが付属します。それ以降は1,000件のリクエストにつき14ドルです。クォータはモデルごとではなく月ごとのプールであるため、グラウンディングされた3 Proの実験とグラウンディングされた3.8 Flashの実験は、同じ5,000件から消費されます。新鮮なデータを必要とするプロトタイプにとっては寛大な許容量ですが、本番機能では予算を考慮する必要があります。
無料枠を使い切ったとき: 最も安価な有料経路
その瞬間は訪れるでしょう。デモ中に429エラーが発生したり、午後3時に日次制限に達したりするかもしれません。4つの有料ステップを、安い順に紹介します。
請求アカウントをリンクする(Tier 1)。 AI Studioでプロジェクトに請求を関連付けると、Tier 1に移行し、レート制限が引き上げられ、250ドルの支出上限が設定されます。Tier 2は100ドルの支出と3日後に2,000ドルの上限で開放され、Tier 3は1,000ドルの支出と30日後に開放されます。Tier 1を解除するために何かを支払う必要はありません。請求のリンク自体がその役割を果たします。
導入料金を支払う。 2026年12月31日まで、3.8 Flashは入力トークン100万件あたり0.75ドル、出力トークン100万件あたり3.75ドルで、思考トークンは出力として請求されます。2027年1月1日からは、どちらも2倍の1.50ドルと7.50ドルになります。導入価格では、入力2,000トークン、出力500トークンのリクエストを1,000回行うと約3.38ドルになります。料金の内訳では、このモデルでトークンあたりの価格が安くてもタスクの価格が安くならない理由を含め、タスクごとの計算方法が説明されています。
待てるものはバッチ処理する。 バッチAPIは料金を半額にします: 年末までは入力100万件あたり0.375ドル、出力100万件あたり1.875ドルです。同じ1,000件のリクエストで、約1.69ドルになります。Tier 1アカウントは、一度に最大300万トークンをキューに入れることができます。評価、バックフィル、夜間ジョブはここに属します。当社のGeminiバッチモードガイドでは、リクエストの形式について説明しています。
安定したプレフィックスをキャッシュする。 コンテキストキャッシュは、導入料金でキャッシュされたトークン100万件あたり0.075ドルかかり、これは新規入力の10分の1です。長いシステムプロンプトや、ターンごとに再送信するドキュメントがある場合は、最初に検討すべき点です。
無料枠では得られないもの
このトピックに関する検索結果は不正確なものが多いため、正直なリストです。
- Geminiアプリ。 上述の通り、ProまたはUltraのみ。
- プライバシー。 無料枠のデータはGoogleの製品改善のために使用されます。無料枠にはこの設定を切り替えるオプションはありません。
- 余裕。 制限はレート制限ページに表示されており、寛大なものではありません。無料は評価や小規模なツール向けであり、本番稼働向けではありません。
- Gemini 3.8 Flash Cyber。 セキュリティに特化したこのモデルは、政府、インフラ事業者、ソフトウェア保守者向けのFairwindプログラムのゲートで保護されています。公開API、価格、セルフホスティングは提供されていません。このプログラムの外部では、無料か有料かを問わず誰も利用できません。
- ライブAPI、画像生成、音声生成。 3.8 Flashは、どの層でもこれらをサポートしていません。入力はテキスト、画像、動画、音声、PDFにできますが、出力はテキストです。
- 「無制限」層。 無制限のGeminiアクセスを謳うサイトは、誰かのキーをプロキシしているか、異なるモデルを提供しています。無料Gemini APIアクセスガイドではその見分け方について説明しており、Gemini 3.6 Flashで機能したのと同じ無料枠の利用方法がここでも適用されます。
Apidogで無料クォータを最大限に活用する
無料枠は規律に報います。手動で再入力するすべてのリクエスト、誤ってトリガーするすべての429エラー、そして不要な高レベル思考の呼び出しは、取り戻せないクォータです。Apidogは、この規律を安価にします。
GEMINI_API_KEYをApidog環境の環境変数として保存し、キーがリクエストボディや共有コレクションに表示されないようにします。Interactions呼び出しとレガシーのgenerateContent呼び出しを、プロンプト、モデル、thinking_levelが入力された名前付きリクエストとして保存し、JSONを編集する代わりに変数でレベルを切り替えます。ステータスコードにアサーションを追加して、429エラーが紛らわしい空のレスポンスではなく失敗したテストとして表示されるようにし、レガシーエンドポイントのusageMetadata.thoughtsTokenCountにもアサーションを追加して、どれくらいのクォータが思考に費やされたかを確認できるようにします。
次に、小さなスモークテストをスケジュールします。1日1回のlowリクエストです。これにより、ユーザーが気づく前にモデルの動作や無料制限が変更されたときに通知されます。設定するにはApidogをダウンロードし、タイミングオプションについてはApidogでAPIテストをスケジュールする方法をご覧ください。
よくある質問
Gemini 3.8 Flashは無料ですか? はい、Google AI StudioおよびGemini APIの無料枠を通じて利用できます。ただし、レート制限があり、データはGoogleの製品改善のために使用されます。このモデルは、有料層が使用するのと同じgemini-3.8-flashです。
GeminiアプリでGemini 3.8 Flashを無料で利用できますか? いいえ。アプリでは、Google AI ProおよびUltraのサブスクライバー向けに3.8 Flashを提供しています。サブスクリプションなしで利用できる一般ユーザー向けサービスは、Google検索のAIモードとGoogleスプレッドシートのGeminiです。
Gemini 3.8 Flashの無料枠のレート制限は何ですか? Googleは、ドキュメントテキストではなく、AI Studioのレート制限ページでモデルごとにそれらを表示しており、変更されることがあります。ご自身のプロジェクトについては、そのページをご確認ください。より多く必要な場合は、請求アカウントをリンクすると、支出なしでTier 1に移行できます。
無料枠には思考機能が含まれていますか? はい。3つのレベルすべて(low、medium、high)が無料枠で機能し、mediumがデフォルトです。3.8 Flashではminimalはエラーを返します。思考トークンはトークン制限にカウントされるため、lowが無料クォータを最も長く持続させます。各レベルの測定コストについては、思考レベルの比較をご覧ください。
Gemini 3.8 Flash Cyberは無料ですか? Fairwindプログラム以外では一切利用できません。通常の開発者は3.8 Flashを利用でき、それに対して独自のAPIセキュリティテストを実行できます。
まずは無料で始め、それから判断する
無料枠は、Gemini 3.8 Flashの単なるお試しではなく、本格的な評価環境です。キーを作成し、思考レベルをlowに保ち、機密データをそこに入れないようにし、推測するのではなくレート制限ページを読んでください。429エラーが発生して時間を無駄にするようになったら、Tier 1のために請求をリンクし、非同期処理にはバッチを使用してください。12月末まで入力トークン100万件あたり0.375ドルなので、最初の有料月は、無料枠のリセットを待っている間に飲んだコーヒーよりも費用がかからない可能性があります。
