Gemini 3.8 Flash wurde am 2. September 2026 veröffentlicht, und im Gegensatz zu den meisten bahnbrechenden Veröffentlichungen dieses Jahres bietet es einen echten kostenlosen Zugang. Sie können kostenlos damit in Google AI Studio chatten und es über die Gemini API im kostenlosen Tarif mit einem Schlüssel aufrufen, dessen Erstellung etwa eine Minute dauert. Googles Ankündigungs-Post nennt es „unser intelligentestes Flash-Modell“, und der kostenlose Tarif bietet Ihnen dieselbe Modell-ID (gemini-3.8-flash), die auch zahlende Kunden nutzen, und keine abgespeckte Variante.
Es gibt drei Haken, und dieser Leitfaden behandelt sie alle. Der kostenlose Tarif ist ratenbegrenzt. Google gibt an, dass Daten aus dem kostenlosen Tarif zur Verbesserung seiner Produkte verwendet werden. Und die Gemini-App enthält 3.8 Flash nicht in ihrem kostenlosen Plan; dafür benötigen Sie ein Google AI Pro- oder Ultra-Abonnement. Wenn Sie zuerst das vollständige Datenblatt wünschen, beginnen Sie mit was Gemini 3.8 Flash ist. Wenn Sie in den nächsten fünf Minuten eine Anfrage ausführen möchten, lesen Sie weiter.
Kostenloser Zugang auf einen Blick
| Oberfläche | Kosten | Gemini 3.8 Flash enthalten? | Der Haken |
|---|---|---|---|
| Google AI Studio (Web-Spielplatz) | 0 $ | Ja | Ratenbegrenzt; Daten werden zur Produktverbesserung genutzt |
| Gemini API kostenloser Tarif | 0 $ | Ja | Gleiche Limits, auf der AI Studio Ratenlimit-Seite angezeigt |
| Gemini App, kostenloser Plan | 0 $ | Nein | 3.8 Flash erfordert Google AI Pro oder Ultra |
| KI-Modus in Google Suche | 0 $ | Ja (privater Nutzer) | Keine API, keine Kontrolle über das Denkniveau |
| Gemini in Google Tabellen | Planabhängig | Ja (privater Nutzer) | Keine API |
| Google Search Grounding | 5.000 Anfragen/Monat kostenlos | Geteilt über Gemini 3.x | Danach 14 $ pro 1.000 Anfragen |
| Batch-API | 50 % Rabatt auf bezahlte Tarife | Ja | Nicht kostenlos; der günstigste kostenpflichtige Weg |
| Gemini 3.8 Flash Cyber | Nicht erhältlich | Nein | Nur Fairwind-Programm, keine öffentliche API zu keinem Preis |

Schritt 1: AI Studio öffnen und gemini-3.8-flash auswählen
Gehen Sie zu Google AI Studio und melden Sie sich mit einem Google-Konto an. Kein Abrechnungskonto, keine Kreditkarte. Wählen Sie im Modellauswähler gemini-3.8-flash; dies ist die stabile ID ohne Vorschau-Suffix. Die Ausführungseinstellungen zeigen das Denkniveau, das bei 3.8 Flash drei Werte hat: niedrig, mittel und hoch. Mittel ist die Standardeinstellung. Bei diesem Modell gibt es kein minimal, und wenn Sie es über die API senden, erhalten Sie einen Validierungsfehler anstelle eines stillen Fallbacks. Der Leitfaden zu den Denkniveaus erklärt, was jedes Niveau an Token und Zeit kostet.
Zwei Einstellungen sind für die kostenlose Nutzung wichtig. Erstens, lassen Sie die Temperatur unverändert. Googles Empfehlung für jedes Gemini 3 Modell ist, sie auf dem Standardwert von 1.0 zu belassen, da eine Senkung zu Schleifen oder einer verschlechterten Ausgabe führen kann. Zweitens, beginnen Sie bei niedrig, während Sie experimentieren. 3.8 Flash wurde entwickelt, um bei komplexen Aufgaben „härter zu arbeiten“, indem es kleinere Denkschritte unternimmt und Tools iterativ aufruft, und Google sagt, dass es „konstruktionsbedingt mehr Token für länger dauernde und komplexe Aufgaben verwenden kann“. In einem Tarif, der in Token pro Minute gemessen wird, verbraucht dieser Bedarf Ihr Kontingent schneller als 3.7 Flash. Niedrig hält die Experimente günstig.
Schritt 2: Kostenlosen API-Schlüssel erhalten
Öffnen Sie in AI Studio die Seite für API-Schlüssel und erstellen Sie einen Schlüssel in einem neuen oder bestehenden Projekt. Der Schlüssel ist kostenlos und funktioniert sofort im kostenlosen Tarif. Die Preisseite führt den Input und Output von 3.8 Flash in diesem Tarif als „Kostenlos“ auf, zusammen mit den kostenpflichtigen Tarifen. Unser Anleitung zum Gemini API-Schlüssel enthält Screenshots, falls Sie es noch nie gemacht haben.
Speichern Sie den Schlüssel als Umgebungsvariable und halten Sie ihn aus Ihrem Code und Ihrer Shell-Historie fern:
export GEMINI_API_KEY="paste-your-key-here"
Behandeln Sie den Schlüssel wie ein Passwort. Der kostenlose Tarif ist nicht an eine Abrechnung gebunden, sodass ein durchgesickerter Schlüssel keine Rechnung verursachen kann, aber er kann Ihr tägliches Kontingent verbrauchen, bevor Sie es tun.
Schritt 3: Ihren ersten kostenlosen Aufruf tätigen
Gemini 3.x läuft jetzt hauptsächlich über die Interactions API. Eine Anfrage, kein SDK erforderlich:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
Die Antwort ist eine Liste von Ausführungsschritten (Modellgedanken, ggf. Tool-Aufrufe), die mit einem model_output-Schritt mit dem Text endet. Wenn Sie bestehenden Code auf generateContent haben, funktioniert dieser weiterhin; Google nennt es veraltet, aber „vollständig unterstützt“ ohne Enddatum, und generationConfig.thinkingConfig.thinkingLevel ist der Ort, an dem das Niveau an diesem Endpunkt festgelegt wird. Beide Formen, plus die Python-Äquivalente und Multi-Turn mit previous_interaction_id, finden Sie im Gemini 3.8 Flash API-Leitfaden.
Wenn Sie eine 429 erhalten, haben Sie das Ratenlimit des kostenlosen Tarifs erreicht. Warten Sie oder lesen Sie weiter zu Stufe 1.
Was der kostenlose Tarif Sie kostet
Nichts in Dollar. Ansonsten drei Dinge.
- Ratenlimits. Der kostenlose Tarif begrenzt Anfragen pro Minute, Token pro Minute und Anfragen pro Tag pro Modell. Google veröffentlicht die genauen Zahlen nur auf der AI Studio Ratenlimit-Seite, nicht im Dokumentationstext, und sie ändern sich ohne Changelog-Eintrag. Überprüfen Sie diese Seite, anstatt sich auf Zahlen zu verlassen, die Sie in einem Blog lesen, einschließlich dieses hier. Das Ratenlimit-Dokument erklärt, wie die Tarife gestapelt sind.
- Ihre Daten. Google gibt an, dass Prompts und Ausgaben des kostenlosen Tarifs zur Verbesserung seiner Produkte verwendet werden. Das ist in Ordnung für einen Benchmark-Prompt oder eine Spielzeug-App. Es ist nicht in Ordnung für Kundendaten, unveröffentlichten Quellcode oder alles, was unter einer Geheimhaltungsvereinbarung steht. Kostenpflichtige Tarife haben andere Bedingungen; wenn Sie diese benötigen, verknüpfen Sie die Abrechnung, bevor Sie die sensible Anfrage senden, nicht danach.
- Token-Verbrauch. Artificial Analysis maß bei 3.8 Flash auf hohem Niveau etwa 48.000 Output-Token pro Aufgabe in ihrem Index, 30 % mehr als bei 3.7 Flash. Denk-Token zählen gegen dieselben Token-pro-Minute-Limits wie die sichtbare Ausgabe. Ein Modell, das härter denkt, ist ein Modell, das Ihr kostenloses Kontingent schneller verbraucht, was der praktische Grund ist, standardmäßig
niedrigodermittelzu verwenden, bis Sie für mehr Spielraum bezahlt haben.
Die Gemini-App ist kein kostenloser Weg
Hier gehen die meisten Suchanfragen nach „Gemini 3.8 Flash kostenlos“ schief. Auf der Konsumentenseite ist 3.8 Flash in der Gemini-App für Google AI Pro- und Ultra-Abonnenten verfügbar. Der kostenlose App-Plan erhält es laut der Startberichterstattung nicht. Wenn Sie die App ohne Abonnement öffnen und ein Flash-Modell sehen, ist es nicht 3.8.
Die Oberflächen für Endverbraucher, auf denen Sie 3.8 Flash ohne zusätzliche Kosten nutzen können, sind der KI-Modus in der Google Suche und Gemini in Google Tabellen. Beide sind nützlich, um seine Antworten zu lesen. Keines davon bietet Ihnen eine Kontrolle des Denkniveaus, eine Token-Zählung oder eine API, daher sind für alles, was man als Entwicklung bezeichnen würde, AI Studio und der kostenlose API-Tarif der echte kostenlose Weg.
Kostenloses Grounding: 5.000 Google Search Anfragen pro Monat
Google Search Grounding, das dem Modell ermöglicht, aktuelle Webergebnisse in seine Antwort zu integrieren, beinhaltet 5.000 kostenlose Anfragen pro Monat, die über alle Gemini 3.x Modelle geteilt werden. Danach kostet es 14 $ pro 1.000 Anfragen. Das Kontingent ist ein monatlicher Pool, nicht pro Modell, sodass ein mit Grounding versehenes 3 Pro-Experiment und ein mit Grounding versehenes 3.8 Flash-Experiment aus denselben 5.000 schöpfen. Für einen Prototyp, der aktuelle Daten benötigt, ist das eine großzügige Freigrenze; für ein Produktions-Feature benötigen Sie eine Budgetposition.
Wenn das Kostenlose aufgebraucht ist: die günstigsten kostenpflichtigen Wege
Sie werden den Moment erkennen. Eine 429 kommt mitten in der Demo an, oder das Tageslimit ist um 15 Uhr erreicht. Vier kostenpflichtige Schritte, der günstigste zuerst.
- Ein Abrechnungskonto verknüpfen (Stufe 1). Das Verknüpfen einer Abrechnung mit Ihrem Projekt in AI Studio verschiebt Sie in Stufe 1, was die Ratenlimits erhöht und ein Ausgabenlimit von 250 $ festlegt. Stufe 2 öffnet sich nach 100 $ Ausgaben plus drei Tagen, mit einem Limit von 2.000 $; Stufe 3 nach 1.000 $ und 30 Tagen. Sie müssen nichts ausgeben, um Stufe 1 freizuschalten; die Abrechnungsverknüpfung selbst erledigt das.
- Den Einführungspreis zahlen. Bis zum 31. Dezember 2026 kostet 3.8 Flash 0,75 $ pro Million Input-Token und 3,75 $ pro Million Output-Token, wobei Denk-Token als Output abgerechnet werden. Ab dem 1. Januar 2027 verdoppeln sich beide Preise auf 1,50 $ und 7,50 $. Tausend Anfragen mit jeweils 2.000 Input- und 500 Output-Token belaufen sich auf etwa 3,38 $ zum Einführungspreis. Die Preisübersicht erläutert die Berechnung pro Aufgabe, einschließlich warum ein günstigerer Preis pro Token bei diesem Modell nicht unbedingt eine günstigere Aufgabe bedeutet.
- Alles, was warten kann, in Batches verarbeiten. Die Batch-API halbiert den Preis: 0,375 $ für Input und 1,875 $ für Output pro Million bis Jahresende. Dieselbe Tausend Anfragen, etwa 1,69 $. Tier-1-Konten können bis zu 3 Millionen Token gleichzeitig in der Warteschlange haben. Evaluierungen, Nachladungen und nächtliche Jobs gehören hierher; unser Gemini Batch-Modus Leitfaden behandelt die Anfrageform.
- Den stabilen Präfix cachen. Kontext-Caching kostet 0,075 $ pro Million gecachter Token zum Einführungspreis, ein Zehntel des frischen Inputs. Ein langer System-Prompt oder ein Dokument, das Sie bei jeder Runde erneut senden, ist der erste Ansatzpunkt.
Was Sie mit der kostenlosen Version nicht bekommen
Eine ehrliche Liste, denn die Suchergebnisse zu diesem Thema sind voll von unehrlichen.
- Die Gemini-App. Nur Pro oder Ultra, wie oben erwähnt.
- Privatsphäre. Daten aus dem kostenlosen Tarif werden zur Verbesserung der Google-Produkte verwendet. Es gibt keine Option zum Deaktivieren im kostenlosen Tarif.
- Spielraum. Die Limits sind auf der Ratenlimit-Seite aufgeführt und nicht großzügig. Kostenlos ist für Evaluierungen und kleine Tools gedacht, nicht für einen Launch.
- Gemini 3.8 Flash Cyber. Das auf Sicherheit abgestimmte Zwilling ist hinter dem Fairwind-Programm für Regierungen, Infrastrukturbetreiber und Software-Wartungsfirmen geschützt. Keine öffentliche API, kein Preis, kein Self-Hosting. Niemand außerhalb dieses Programms hat es, kostenlos oder kostenpflichtig.
- Live API, Bildgenerierung oder Audio-Generierung. 3.8 Flash unterstützt diese Funktionen in keinem Tarif. Inputs können Text, Bild, Video, Audio und PDF sein; der Output ist Text.
- Ein „unbegrenzter“ Tarif. Seiten, die uneingeschränkten Gemini-Zugang versprechen, nutzen den Schlüssel eines anderen oder stellen ein anderes Modell bereit. Der Leitfaden für kostenlosen Gemini API-Zugang erklärt, wie man das erkennt, und derselbe Leitfaden für den kostenlosen Tarif, der für Gemini 3.6 Flash funktionierte, gilt auch hier.
Nutzen Sie das kostenlose Kontingent besser mit Apidog
Ein kostenloser Tarif belohnt Disziplin. Jede Anfrage, die Sie manuell neu eingeben, jede 429, die Sie versehentlich auslösen, und jeder unnötige Aufruf mit hohem Denkniveau ist ein Kontingent, das Sie nicht zurückbekommen. Apidog macht diese Disziplin günstig.
Speichern Sie GEMINI_API_KEY als Umgebungsvariable in einer Apidog-Umgebung, damit der Schlüssel niemals in einem Request-Body oder einer geteilten Sammlung erscheint. Speichern Sie den Interactions-Aufruf und den veralteten generateContent-Aufruf als benannte Anfragen mit ausgefülltem Prompt, Modell und thinking_level und wechseln Sie die Ebenen mit einer Variablen anstatt JSON zu bearbeiten. Fügen Sie eine Assertion für den Statuscode hinzu, damit eine 429 als fehlgeschlagener Test anstelle einer verwirrenden leeren Antwort angezeigt wird, und eine für usageMetadata.thoughtsTokenCount am alten Endpunkt, damit Sie sehen können, wie viel Ihres Kontingents für das Denken verwendet wurde.
Planen Sie dann einen kleinen Smoke-Test: eine niedrige Anfrage pro Tag. So wissen Sie, wann sich das Verhalten des Modells oder die kostenlosen Limits ändern, bevor Ihre Benutzer es merken. Laden Sie Apidog herunter, um es einzurichten, und erfahren Sie, wie Sie API-Tests in Apidog planen für die Timing-Optionen.
Häufig gestellte Fragen (FAQ)
- Ist Gemini 3.8 Flash kostenlos? Ja, über Google AI Studio und den kostenlosen Tarif der Gemini API, mit Ratenlimits und unter Verwendung Ihrer Daten zur Verbesserung der Google-Produkte. Das Modell ist dasselbe
gemini-3.8-flash, das auch kostenpflichtige Tarife nutzen. - Kann ich Gemini 3.8 Flash kostenlos in der Gemini-App nutzen? Nein. Die App bietet 3.8 Flash Google AI Pro- und Ultra-Abonnenten an. Der KI-Modus in der Google Suche und Gemini in Google Tabellen sind die Verbraucheroberflächen, auf denen Sie es ohne Abonnement nutzen können.
- Wie sind die Ratenlimits für Gemini 3.8 Flash im kostenlosen Tarif? Google zeigt sie pro Modell auf der AI Studio Ratenlimit-Seite anstatt im Dokumentationstext, und sie ändern sich. Überprüfen Sie diese Seite für Ihr Projekt. Wenn Sie mehr benötigen, verschiebt Sie das Verknüpfen eines Abrechnungskontos in Stufe 1, ohne dass Ausgaben erforderlich sind.
- Beinhaltet der kostenlose Tarif das Denken? Ja. Alle drei Niveaus (
niedrig,mittel,hoch) funktionieren im kostenlosen Tarif, undmittelist die Standardeinstellung.minimalführt bei 3.8 Flash zu einem Fehler. Da Denk-Token auf Ihre Token-Limits angerechnet werden, dehntniedrigdas kostenlose Kontingent am weitesten aus; sehen Sie den Vergleich der Denkniveaus für die gemessenen Kosten pro Niveau. - Ist Gemini 3.8 Flash Cyber kostenlos? Es ist außerhalb des Fairwind-Programms überhaupt nicht verfügbar. Reguläre Entwickler erhalten 3.8 Flash und können ihre eigenen API-Sicherheitstests dagegen durchführen.
Kostenlos beginnen, dann entscheiden
Der kostenlose Tarif ist eine echte Evaluierungsumgebung für Gemini 3.8 Flash, kein Teaser. Erstellen Sie einen Schlüssel, halten Sie das Denkniveau auf niedrig, halten Sie sensible Daten davon fern und lesen Sie die Ratenlimit-Seite, anstatt zu raten. Wenn eine 429 beginnt, Ihnen Zeit zu kosten, verknüpfen Sie die Abrechnung für Stufe 1 und nutzen Sie Batch für alles Asynchrone; bei 0,375 $ pro Million Input-Token bis Dezember wird der erste kostenpflichtige Monat wahrscheinlich weniger kosten als der Kaffee, den Sie getrunken haben, während Sie darauf warteten, dass der kostenlose Tarif zurückgesetzt wird.
