Gemini 3.7 Flash Technische Daten und Preise

Gemini 3.7 Flash Spezifikationen im Überblick: 1 Million Kontext, 64k Ausgabe, multimodale Eingabe, Tool-Unterstützung, Benchmarks im Vergleich zu 3.6 Flash, Preismodelle und API-Zugriffskanäle.

Ashley Innocent

Ashley Innocent

19 August 2026

Gemini 3.7 Flash Technische Daten und Preise

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Google hat Gemini 3.7 Flash am 13. August 2026 veröffentlicht, drei Wochen nach 3.6 Flash und während Gemini 3.5 Pro weiterhin verzögert ist. Das Unternehmen nennt es „unser intelligentestes Arbeitspferdmodell“, und die offizielle Ankündigung untermauert diese Behauptung mit Benchmark-Sprünge von 10 bis 16 Punkten bei Codierungs- und Agentenaufgaben. Wenn Sie gegen die Gemini API entwickeln, ist dies das Modell, das Sie für die nächsten Monate verwenden werden.

Diese Seite ist die Referenzkarte. Jede Spezifikation, jeder Preis, jede Benchmark-Änderung und jeder Zugriffskanal an einem Ort, in Tabellen, die Sie in weniger als einer Minute überblicken können. Wenn Sie bereit sind, Code zu schreiben, führt Sie der Schnellstart zur Gemini 3.7 Flash API Schritt für Schritt durch cURL, Python und Node, und Apidog bietet Ihnen einen Arbeitsbereich, um Testanfragen an den Endpunkt zu senden, bevor dieser Code überhaupt existiert.

Speichern Sie diese Seite als Lesezeichen. Die untenstehenden Zahlen ändern sich am 1. Januar 2027, wenn das Einführungs-Preisfenster geschlossen wird, und wir werden die Tabellen aktuell halten.

TL;DR

Gemini 3.7 Flash Spezifikationsblatt

Die Eckdaten, direkt von Googles Gemini Flash Modellseite und den Startmaterialien.

Spezifikation Wert
Modell-ID gemini-3.7-flash
Veröffentlichungsdatum 13. August 2026
Eingabekontextfenster 1.000.000 Tokens
Ausgabetoken-Limit 64.000 Tokens
Eingabemodalitäten Text, Bild, Video, Audio, PDF
Ausgabemodalität Text
Funktionsaufrufe Ja
Suche als Werkzeug Ja
Computernutzung Ja
Abruf langer Kontexte (128k Nadel) 97.0%
Sicherheit Aktualisierte CBRN- und Cyberschutzmaßnahmen
Verfügbarkeit Über 160 Länder
API-Endpunkt generativelanguage.googleapis.com (AI Studio Schlüssel) oder aiplatform.googleapis.com (Vertex, OAuth)

Zwei Zeilen verdienen einen zweiten Blick. Das 64k Ausgabelimit ist großzügig für ein Flash-Klasse-Modell; es bedeutet, dass vollständige Dateiumschreibungen und lange strukturierte Ausgaben in eine einzige Antwort passen. Und die Unterstützung der Computernutzung platziert 3.7 Flash in einer kleinen Gruppe von Modellen, die einen Browser direkt steuern können, obwohl für die meisten Produktionsautomatisierungen ein strukturierter API-Aufruf immer noch die bessere Wahl ist. Die Kompromisse werden unter Computernutzung vs. strukturierte APIs behandelt.

Preise auf einen Blick

Google hat 3.7 Flash zum halben Einführungspreis von 3.6 Flash auf den Markt gebracht, aber der Rabatt hat ein Ablaufdatum.

Stufe Eingabe (pro 1M Tokens) Ausgabe (pro 1M Tokens) Gültig
Einführung $0.75 $3.75 Bis 31. Dezember 2026
Standard $1.50 $7.50 Ab 1. Januar 2027

Das ist ein sauberer 2-facher Sprung auf beiden Seiten am Neujahrstag. Wenn Ihre Arbeitslast Token-intensiv ist, ist das Einführungsfenster die Zeit, um Benchmarks durchzuführen, Prompts zu optimieren und Caching-Strategien festzulegen, während Fehler nur die Hälfte kosten. Für ausgearbeitete Kostenbeispiele, Token-Berechnungen bei realen Arbeitslasten und Strategien zur Kostensenkung, bevor die Standardpreise greifen, siehe Gemini 3.7 Flash Preise erklärt. Die aktuelle Informationsquelle ist die Gemini API Preisgestaltungsseite.

Benchmarks: 3.6 Flash vs. 3.7 Flash

Google veröffentlichte Deltas gegenüber 3.6 Flash in den Bereichen Codierung, Webentwicklung, Dokumentenverständnis und agentenbasierte Automatisierung. Die Unterschiede sind groß für ein Punkt-Release, das drei Wochen nach seinem Vorgänger erschien, ein Punkt, den auch 9to5Googles Startberichterstattung hervorhob.

Benchmark Gemini 3.6 Flash Gemini 3.7 Flash Delta
DeepSWE v1.1 (agentenbasierte Codierung) 49.0% 65.3% +16.3
FrontierCode 1.1 Main 34.4% 43.6% +9.2
WebDev Arena (Elo) 1538 1588 +50
GDP.pdf (Dokumentenverständnis) 22.0% 34.0% +12.0
AutomationBench (agentenbasierte Automatisierung) 17.0% 30.4% +13.4
Harvey LAB-AA (Recht) n.v. 90.7% n.v.
128k-Nadel-Retrieval n.v. 97.0% n.v.

Das Muster in der Tabelle: Agenten-Arbeitslasten haben am meisten gewonnen. Googles angegebene Verbesserungen stimmen überein: besseres Debugging, leichter einsetzbarer erster Code, sorgfältigeres Denken bei mehrstufiger Planung und Tool-Aufrufen sowie strengere Befolgung von Anweisungen. Wie sich diese Zahlen im Vergleich zu Anthropic- und OpenAI-Modellen verhalten, ist eine andere Frage, die in Gemini 3.7 Flash vs. Claude vs. GPT beantwortet wird.

Wo Sie Gemini 3.7 Flash verwenden können

Sieben Zugriffskanäle zum Start. Wählen Sie nach Rolle.

Kanal Wofür es ist Wen es bedient
Gemini API Programmatischer Zugriff mit einem AI Studio Schlüssel Entwickler, die Apps veröffentlichen
Google AI Studio Browser-Spielplatz, Prompt-Iteration, Schlüsselverwaltung Entwickler, die Prototypen erstellen
Gemini App Verbraucher-Chat im Web und auf Mobilgeräten Endbenutzer
Gemini Spark Agentenbasierte Codierungsumgebung Abonnenten von AI Pro und Ultra
Google Antigravity Agent-First-Entwicklungsplattform Teams, die autonome Agenten entwickeln
Android Studio IDE-Integration für Android-Arbeit Mobile Entwickler
Gemini Enterprise Verwaltete Bereitstellung mit Admin-Kontrollen Unternehmens-IT

Für die API-Arbeit erhalten Sie über den AI Studio-Schlüsselpfad in wenigen Minuten eine funktionierende Anfrage. Vertex AI bietet dasselbe Modell hinter OAuth mit IAM, Audit-Logs und regionalen Endpunkten, wenn Sie Produktionskontrollen benötigen.

Eine minimale funktionierende Anfrage

Holen Sie sich einen Schlüssel von AI Studio, exportieren Sie ihn und senden Sie eine Anfrage.

export GEMINI_API_KEY="AIza..."

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'

Streaming tauscht die Methode für :streamGenerateContent?alt=sse auf demselben Pfad aus. Die Antwort gibt ein candidates-Array mit den Textteilen und einen usageMetadata-Block mit den Token-Anzahlen zurück, nach denen Sie abgerechnet werden.

Wenn Sie JSON lieber nicht manuell in einem Terminal bearbeiten möchten, importiert Apidog die Generative Language API Spezifikation, bindet GEMINI_API_KEY als Umgebungsvariable im x-goog-api-key Header und rendert SSE-Streams live. Speichern Sie eine gute Antwort einmal als Beispiel und führen Sie Tests gegen die Fixture anstatt gegen den kostenpflichtigen Endpunkt erneut aus.

Ratenbegrenzungen und Stufen

Google legt Ratenbegrenzungen pro Modell und pro Stufe fest (kostenlos, Pay-as-you-go und bereitgestellte Stufen), und die Zahlen ändern sich oft genug, dass jede hier abgedruckte Tabelle veralten würde. Überprüfen Sie die offizielle Gemini API-Dokumentation für die aktuellen Anfragen-pro-Minute- und Token-pro-Minute-Begrenzungen für gemini-3.7-flash.

Zwei Faustregeln, die stabil sind. Das kostenlose Kontingent über AI Studio reicht aus, um Prototypen zu erstellen, aber nicht, um sie zu veröffentlichen. Und ein 429er-Fehler mit dem Status RESOURCE_EXHAUSTED bedeutet, dass Sie eine Pro-Minute- oder Pro-Tag-Grenze erreicht haben; ziehen Sie sich mit Jitter zurück, verarbeiten Sie, wo möglich, in Batches, oder verschieben Sie das Projekt auf eine kostenpflichtige Stufe.

Schnellzugriffe

FAQ

Was sind die Spezifikationen von Gemini 3.7 Flash in einem Satz?

Ein 1M Token Eingabekontextfenster, ein 64k Token Ausgabebeschränkung, multimodale Eingabe über Text, Bild, Video, Audio und PDF, Textausgabe und Unterstützung für Funktionsaufrufe, Suche als Werkzeug und Computernutzung, adressierbar als gemini-3.7-flash über die Gemini API.

Wie viel kostet Gemini 3.7 Flash?

$0.75 pro 1M Eingabetokens und $3.75 pro 1M Ausgabetokens bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 gelten die Standardpreise: $1.50 für Eingabe und $7.50 für Ausgabe. Der Einführungspreis beträgt die Hälfte dessen, womit 3.6 Flash gestartet wurde.

Muss ich meinen Code ändern, um von 3.6 Flash zu aktualisieren?

Der Austausch selbst ist eine Zeile: Ändern Sie die Modell-ID zu gemini-3.7-flash. Die Verhaltensänderungen sind die eigentliche Arbeit, da 3.7 bei mehrstufigen Tool-Aufrufen länger nachdenkt und Anweisungen strenger befolgt. Der Migrationsleitfaden von 3.6 zu 3.7 Flash behandelt, was Sie vor der Umstellung des Traffics regressionstesten sollten.

Warum hat Google 3.7 Flash vor Gemini 3.5 Pro veröffentlicht?

Gemini 3.5 Pro ist weiterhin verzögert, und Axios berichtete, dass Google Flash-Updates vor seinem nächsten Flaggschiff veröffentlicht, anstatt Verbesserungen zurückzuhalten. Der dreiwöchige Abstand zwischen 3.6 und 3.7 Flash passt zu diesem Rhythmus.

Gibt es eine kostenlose Möglichkeit, es auszuprobieren?

Ja. Der kostenlose Tarif von AI Studio beinhaltet ein tägliches Kontingent für gemini-3.7-flash, ausreichend für Prompt-Tests und kleine Prototypen, und es ist kein Abrechnungskonto erforderlich, bis Sie höhere Ratenbegrenzungen benötigen. Der Leitfaden für den kostenlosen Gemini API-Zugang erklärt, wie weit der kostenlose Tarif reicht und was zu tun ist, wenn Sie seine Grenzen erreichen.

Wo 3.7 Flash in Ihren Stack passt

Behandeln Sie 3.7 Flash als Standard-Gemini-Modell für Agentenschleifen, Codierungsassistenten, Dokumentenpipelines und alles, was viele Tool-Aufrufe pro Sitzung durchführt. Die Benchmark-Verbesserungen liegen genau dort, wo diese Arbeitslasten angesiedelt sind, und die Einführungspreise machen die nächsten viereinhalb Monate zum günstigsten Zeitraum für die Entwicklung. Beurteilen Sie Flaggschiff-ähnliche Denkfähigkeiten erst, wenn Gemini 3.5 Pro veröffentlicht wird; für alles andere ist dies das Arbeitspferd, das Google verspricht.

Bevor die Modell-ID in die Nähe von Produktionscode kommt, testen Sie den Endpunkt. Laden Sie Apidog herunter, um Ihre Gemini-Anfragen, Umgebungen, Streaming-Überprüfungen und gespeicherten Antwort-Fixtures in einem Arbeitsbereich zu verwalten, zusammen mit Sammlungen für jeden anderen Anbieter, den Sie evaluieren.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen