Google hat Gemini 3.7 Flash am 13. August 2026 veröffentlicht, drei Wochen nach 3.6 Flash und während Gemini 3.5 Pro weiterhin verzögert ist. Das Unternehmen nennt es „unser intelligentestes Arbeitspferdmodell“, und die offizielle Ankündigung untermauert diese Behauptung mit Benchmark-Sprünge von 10 bis 16 Punkten bei Codierungs- und Agentenaufgaben. Wenn Sie gegen die Gemini API entwickeln, ist dies das Modell, das Sie für die nächsten Monate verwenden werden.
Diese Seite ist die Referenzkarte. Jede Spezifikation, jeder Preis, jede Benchmark-Änderung und jeder Zugriffskanal an einem Ort, in Tabellen, die Sie in weniger als einer Minute überblicken können. Wenn Sie bereit sind, Code zu schreiben, führt Sie der Schnellstart zur Gemini 3.7 Flash API Schritt für Schritt durch cURL, Python und Node, und Apidog bietet Ihnen einen Arbeitsbereich, um Testanfragen an den Endpunkt zu senden, bevor dieser Code überhaupt existiert.
Speichern Sie diese Seite als Lesezeichen. Die untenstehenden Zahlen ändern sich am 1. Januar 2027, wenn das Einführungs-Preisfenster geschlossen wird, und wir werden die Tabellen aktuell halten.
TL;DR
- Modell-ID ist
gemini-3.7-flash, seit dem 13. August 2026 in der Gemini API live, verfügbar in über 160 Ländern. - Spezifikationen: 1M Token Eingabekontext, 64k Token Ausgabebeschränkung, multimodale Eingabe (Text, Bild, Video, Audio, PDF), Textausgabe.
- Werkzeuge: Funktionsaufrufe, Suche als Werkzeug und Computernutzung werden alle unterstützt.
- Einführungspreise: $0.75 pro 1M Eingabetokens und $3.75 pro 1M Ausgabetokens bis zum 31. Dezember 2026. Die Standardpreise verdoppeln sich am 1. Januar 2027 auf $1.50 und $7.50.
- Benchmarks gegenüber 3.6 Flash: DeepSWE v1.1 49.0% auf 65.3%, AutomationBench 17.0% auf 30.4%, WebDev Arena Elo 1538 auf 1588.
- Zugriff über die Gemini API, Google AI Studio, die Gemini App, Gemini Spark, Google Antigravity, Android Studio und Gemini Enterprise.
Gemini 3.7 Flash Spezifikationsblatt
Die Eckdaten, direkt von Googles Gemini Flash Modellseite und den Startmaterialien.
| Spezifikation | Wert |
|---|---|
| Modell-ID | gemini-3.7-flash |
| Veröffentlichungsdatum | 13. August 2026 |
| Eingabekontextfenster | 1.000.000 Tokens |
| Ausgabetoken-Limit | 64.000 Tokens |
| Eingabemodalitäten | Text, Bild, Video, Audio, PDF |
| Ausgabemodalität | Text |
| Funktionsaufrufe | Ja |
| Suche als Werkzeug | Ja |
| Computernutzung | Ja |
| Abruf langer Kontexte (128k Nadel) | 97.0% |
| Sicherheit | Aktualisierte CBRN- und Cyberschutzmaßnahmen |
| Verfügbarkeit | Über 160 Länder |
| API-Endpunkt | generativelanguage.googleapis.com (AI Studio Schlüssel) oder aiplatform.googleapis.com (Vertex, OAuth) |
Zwei Zeilen verdienen einen zweiten Blick. Das 64k Ausgabelimit ist großzügig für ein Flash-Klasse-Modell; es bedeutet, dass vollständige Dateiumschreibungen und lange strukturierte Ausgaben in eine einzige Antwort passen. Und die Unterstützung der Computernutzung platziert 3.7 Flash in einer kleinen Gruppe von Modellen, die einen Browser direkt steuern können, obwohl für die meisten Produktionsautomatisierungen ein strukturierter API-Aufruf immer noch die bessere Wahl ist. Die Kompromisse werden unter Computernutzung vs. strukturierte APIs behandelt.
Preise auf einen Blick
Google hat 3.7 Flash zum halben Einführungspreis von 3.6 Flash auf den Markt gebracht, aber der Rabatt hat ein Ablaufdatum.
| Stufe | Eingabe (pro 1M Tokens) | Ausgabe (pro 1M Tokens) | Gültig |
|---|---|---|---|
| Einführung | $0.75 | $3.75 | Bis 31. Dezember 2026 |
| Standard | $1.50 | $7.50 | Ab 1. Januar 2027 |
Das ist ein sauberer 2-facher Sprung auf beiden Seiten am Neujahrstag. Wenn Ihre Arbeitslast Token-intensiv ist, ist das Einführungsfenster die Zeit, um Benchmarks durchzuführen, Prompts zu optimieren und Caching-Strategien festzulegen, während Fehler nur die Hälfte kosten. Für ausgearbeitete Kostenbeispiele, Token-Berechnungen bei realen Arbeitslasten und Strategien zur Kostensenkung, bevor die Standardpreise greifen, siehe Gemini 3.7 Flash Preise erklärt. Die aktuelle Informationsquelle ist die Gemini API Preisgestaltungsseite.
Benchmarks: 3.6 Flash vs. 3.7 Flash
Google veröffentlichte Deltas gegenüber 3.6 Flash in den Bereichen Codierung, Webentwicklung, Dokumentenverständnis und agentenbasierte Automatisierung. Die Unterschiede sind groß für ein Punkt-Release, das drei Wochen nach seinem Vorgänger erschien, ein Punkt, den auch 9to5Googles Startberichterstattung hervorhob.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash | Delta |
|---|---|---|---|
| DeepSWE v1.1 (agentenbasierte Codierung) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Main | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (Dokumentenverständnis) | 22.0% | 34.0% | +12.0 |
| AutomationBench (agentenbasierte Automatisierung) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (Recht) | n.v. | 90.7% | n.v. |
| 128k-Nadel-Retrieval | n.v. | 97.0% | n.v. |
Das Muster in der Tabelle: Agenten-Arbeitslasten haben am meisten gewonnen. Googles angegebene Verbesserungen stimmen überein: besseres Debugging, leichter einsetzbarer erster Code, sorgfältigeres Denken bei mehrstufiger Planung und Tool-Aufrufen sowie strengere Befolgung von Anweisungen. Wie sich diese Zahlen im Vergleich zu Anthropic- und OpenAI-Modellen verhalten, ist eine andere Frage, die in Gemini 3.7 Flash vs. Claude vs. GPT beantwortet wird.
Wo Sie Gemini 3.7 Flash verwenden können
Sieben Zugriffskanäle zum Start. Wählen Sie nach Rolle.
| Kanal | Wofür es ist | Wen es bedient |
|---|---|---|
| Gemini API | Programmatischer Zugriff mit einem AI Studio Schlüssel | Entwickler, die Apps veröffentlichen |
| Google AI Studio | Browser-Spielplatz, Prompt-Iteration, Schlüsselverwaltung | Entwickler, die Prototypen erstellen |
| Gemini App | Verbraucher-Chat im Web und auf Mobilgeräten | Endbenutzer |
| Gemini Spark | Agentenbasierte Codierungsumgebung | Abonnenten von AI Pro und Ultra |
| Google Antigravity | Agent-First-Entwicklungsplattform | Teams, die autonome Agenten entwickeln |
| Android Studio | IDE-Integration für Android-Arbeit | Mobile Entwickler |
| Gemini Enterprise | Verwaltete Bereitstellung mit Admin-Kontrollen | Unternehmens-IT |
Für die API-Arbeit erhalten Sie über den AI Studio-Schlüsselpfad in wenigen Minuten eine funktionierende Anfrage. Vertex AI bietet dasselbe Modell hinter OAuth mit IAM, Audit-Logs und regionalen Endpunkten, wenn Sie Produktionskontrollen benötigen.
Eine minimale funktionierende Anfrage
Holen Sie sich einen Schlüssel von AI Studio, exportieren Sie ihn und senden Sie eine Anfrage.
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
Streaming tauscht die Methode für :streamGenerateContent?alt=sse auf demselben Pfad aus. Die Antwort gibt ein candidates-Array mit den Textteilen und einen usageMetadata-Block mit den Token-Anzahlen zurück, nach denen Sie abgerechnet werden.
Wenn Sie JSON lieber nicht manuell in einem Terminal bearbeiten möchten, importiert Apidog die Generative Language API Spezifikation, bindet GEMINI_API_KEY als Umgebungsvariable im x-goog-api-key Header und rendert SSE-Streams live. Speichern Sie eine gute Antwort einmal als Beispiel und führen Sie Tests gegen die Fixture anstatt gegen den kostenpflichtigen Endpunkt erneut aus.
Ratenbegrenzungen und Stufen
Google legt Ratenbegrenzungen pro Modell und pro Stufe fest (kostenlos, Pay-as-you-go und bereitgestellte Stufen), und die Zahlen ändern sich oft genug, dass jede hier abgedruckte Tabelle veralten würde. Überprüfen Sie die offizielle Gemini API-Dokumentation für die aktuellen Anfragen-pro-Minute- und Token-pro-Minute-Begrenzungen für gemini-3.7-flash.
Zwei Faustregeln, die stabil sind. Das kostenlose Kontingent über AI Studio reicht aus, um Prototypen zu erstellen, aber nicht, um sie zu veröffentlichen. Und ein 429er-Fehler mit dem Status RESOURCE_EXHAUSTED bedeutet, dass Sie eine Pro-Minute- oder Pro-Tag-Grenze erreicht haben; ziehen Sie sich mit Jitter zurück, verarbeiten Sie, wo möglich, in Batches, oder verschieben Sie das Projekt auf eine kostenpflichtige Stufe.
Schnellzugriffe
- Offizielle Ankündigung: Startbeitrag mit Googles Behauptungen und Benchmark-Diagrammen
- Gemini API-Dokumentation: Endpunktreferenz, SDK-Anleitungen, Ratenbegrenzungen
- Preisseite: Aktuelle Raten pro Token
- Modellseite: Spezifikationen und Modalitätsdetails
- API-Schlüssel erhalten: AI Studio Schlüssel in zwei Klicks
FAQ
Was sind die Spezifikationen von Gemini 3.7 Flash in einem Satz?
Ein 1M Token Eingabekontextfenster, ein 64k Token Ausgabebeschränkung, multimodale Eingabe über Text, Bild, Video, Audio und PDF, Textausgabe und Unterstützung für Funktionsaufrufe, Suche als Werkzeug und Computernutzung, adressierbar als gemini-3.7-flash über die Gemini API.
Wie viel kostet Gemini 3.7 Flash?
$0.75 pro 1M Eingabetokens und $3.75 pro 1M Ausgabetokens bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 gelten die Standardpreise: $1.50 für Eingabe und $7.50 für Ausgabe. Der Einführungspreis beträgt die Hälfte dessen, womit 3.6 Flash gestartet wurde.
Muss ich meinen Code ändern, um von 3.6 Flash zu aktualisieren?
Der Austausch selbst ist eine Zeile: Ändern Sie die Modell-ID zu gemini-3.7-flash. Die Verhaltensänderungen sind die eigentliche Arbeit, da 3.7 bei mehrstufigen Tool-Aufrufen länger nachdenkt und Anweisungen strenger befolgt. Der Migrationsleitfaden von 3.6 zu 3.7 Flash behandelt, was Sie vor der Umstellung des Traffics regressionstesten sollten.
Warum hat Google 3.7 Flash vor Gemini 3.5 Pro veröffentlicht?
Gemini 3.5 Pro ist weiterhin verzögert, und Axios berichtete, dass Google Flash-Updates vor seinem nächsten Flaggschiff veröffentlicht, anstatt Verbesserungen zurückzuhalten. Der dreiwöchige Abstand zwischen 3.6 und 3.7 Flash passt zu diesem Rhythmus.
Gibt es eine kostenlose Möglichkeit, es auszuprobieren?
Ja. Der kostenlose Tarif von AI Studio beinhaltet ein tägliches Kontingent für gemini-3.7-flash, ausreichend für Prompt-Tests und kleine Prototypen, und es ist kein Abrechnungskonto erforderlich, bis Sie höhere Ratenbegrenzungen benötigen. Der Leitfaden für den kostenlosen Gemini API-Zugang erklärt, wie weit der kostenlose Tarif reicht und was zu tun ist, wenn Sie seine Grenzen erreichen.
Wo 3.7 Flash in Ihren Stack passt
Behandeln Sie 3.7 Flash als Standard-Gemini-Modell für Agentenschleifen, Codierungsassistenten, Dokumentenpipelines und alles, was viele Tool-Aufrufe pro Sitzung durchführt. Die Benchmark-Verbesserungen liegen genau dort, wo diese Arbeitslasten angesiedelt sind, und die Einführungspreise machen die nächsten viereinhalb Monate zum günstigsten Zeitraum für die Entwicklung. Beurteilen Sie Flaggschiff-ähnliche Denkfähigkeiten erst, wenn Gemini 3.5 Pro veröffentlicht wird; für alles andere ist dies das Arbeitspferd, das Google verspricht.
Bevor die Modell-ID in die Nähe von Produktionscode kommt, testen Sie den Endpunkt. Laden Sie Apidog herunter, um Ihre Gemini-Anfragen, Umgebungen, Streaming-Überprüfungen und gespeicherten Antwort-Fixtures in einem Arbeitsbereich zu verwalten, zusammen mit Sammlungen für jeden anderen Anbieter, den Sie evaluieren.
