Gemini 4 Argon ist Googles neues Vorzeigemodell, das am 30. September 2026 angekündigt wurde und heute nur den Verteidigern des Fairwind-Programms zur Verfügung steht, einer überprüften Gruppe von Cyber-Verteidigungspartnern. Google bepreist es in einer Einführungsphase mit 2 $ pro Million Eingabe-Tokens und 10 $ pro Million Ausgabe-Tokens, danach mit 4 $ bzw. 20 $, und erhöht das Ausgabelimit auf 1 Million Tokens pro Antwort. Es gibt noch keine öffentliche API, keine veröffentlichte Modell-ID und kein Veröffentlichungsdatum.
Dieser Leitfaden ist das Zentrum unserer Argon-Berichterstattung: was Google bestätigt hat und was nicht, wo Argon in der Gemini-Reihe steht, wer es als Nächstes erhält, was es kostet, wie es abschneidet und was Sie heute damit aufbauen können. Sie wählen gerade ein Modell aus? Lesen Sie unseren Vergleich Gemini 4 Argon vs. GPT-6 Astra vs. Claude Opus 5.5. Wenn Sie Modell-APIs in Apidog testen, zeigt der letzte Abschnitt, wie Sie den Wechsel zu Argon mit einer einzigen Wertänderung vornehmen können.
Was Google bestätigt hat vs. was nicht
Die meisten frühen Berichte vermischen Googles Aussagen mit Spekulationen Dritter. Hier ist die Aufteilung, basierend auf dem Launch-Post und Googles Evaluierungsmethodik.
| Punkt | Status | Was wir wissen |
|---|---|---|
| Ankündigung | Bestätigt | 30. September 2026, von Koray Kavukcuoglu von Google DeepMind |
| Zugang heute | Bestätigt | Einige Fairwind-Programmpartner |
| Als Nächstes | Bestätigt, undatiert | Kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten |
| Preis | Bestätigt | 2 $/10 $ Einführung, dann 4 $/20 $ pro 1 Mio. Tokens; zwischengespeicherte Eingabe 95 % Rabatt |
| Ausgabelimit | Bestätigt | 1 Mio. Tokens, gegenüber 64K |
| Benchmarks | Bestätigt, von Google berichtet | Eine 19-zeilige Tabelle plus ein Methodik-PDF |
| Modell-ID | Nicht veröffentlicht | Online-Strings sind Platzhalter Dritter |
| Eingabe-Kontextfenster | Nicht veröffentlicht | Googles Long-Context-Evaluierung verwendete Prompts von bis zu 1 Mio. Tokens |
| Wissensstand | Nicht veröffentlicht | Nichts von Google |
| Dauer der Einführungsphase | Nicht veröffentlicht | Kein Datum für den Wechsel zu 4 $/20 $ |
| Ratenlimits, Free Tier | Nicht veröffentlicht | Nichts von Google |
| Veröffentlichungsdatum | Nicht veröffentlicht | „So bald wie möglich“ |
Wenn eine Website ein Kontextfenster, einen Modellstring oder eine Geschwindigkeitsangabe für Argon auflistet, behandeln Sie diese als unbestätigt, bis Googles eigene Dokumente dies zeigen.
Was Gemini 4 Argon ist und wo es steht
Argon ist das einzige bisher angekündigte Gemini 4 Modell und die neue Spitze von Googles Produktpalette. Google nennt es „unser neues Vorzeigemodell“, das „entwickelt wurde, um tiefgreifende Schlussfolgerungen über komplexe, langwierige Arbeitsabläufe hinweg aufrechtzuerhalten“, und beansprucht Spitzenleistungen in den Bereichen Softwareentwicklung, Unternehmenswissensarbeit wie Recht und Finanzen sowie Cybersicherheitsverteidigung. Ein Google-Sprecher teilte Reuters mit, dass Argon größer ist als die bisherige Linie der „Pro“-Modelle des Unternehmens.

Bisher war das Top-Gemini-API-Modell gemini-3.1-pro-preview, das sich noch in der Vorschau befindet: 1.048.576 Eingabe-Tokens, 65.536 Ausgabe-Tokens (die „64K“, die Argon ersetzt) und 2 $ Eingabe / 12 $ Ausgabe pro Million für Prompts bis zu 200K. Argon’s Einführungspreis von 10 $ für die Ausgabe unterbietet dies. Google hat nicht gesagt, ob Argon eine separate Long-Prompt-Stufe wie 3.1 Pro erhält oder ob weitere Gemini 4 Modelle folgen werden. Reuters beschrieb die Veröffentlichung als „nach Monaten der Verzögerungen“, eine Anspielung auf die Gemini 3.5 Pro-Veröffentlichung, die für Juni versprochen und später fallengelassen wurde.
Google betreibt Argon bereits intern. Es sagt, dass Tausende von Mitarbeitern es zum Codieren, Forschen und Schreiben verwenden, dass Argon-Agenten über 300 TiB Flotten-Speicher freigesetzt haben und dass C- und C++-Code zu Rust migriert wird, bis zu über 800K Zeilen für den Fuchsia Zircon-Kernel, wobei diese Umschreibungen noch vor der Produktion geprüft werden.
Wer Gemini 4 Argon heute nutzen kann und wer als Nächstes
Heute: eine Teilmenge der Fairwind-Partner. Fairwind ist Googles Cyber-Verteidigungsprogramm mit eingeschränktem Zugang und über 650 Partnern, aber nur „einige Fairwind-Programmpartner“ erhalten Argon, eigenständig oder innerhalb von CodeMender, Googles Code-Sicherheitsagenten. Direkt „als verwaltetes Modell auf Gemini Enterprise“ zugegriffen, unterstützt es Zero Data Retention. Partner müssen sich zu Phishing-resistenter MFA verpflichten, der Zugang ist auf interne Sicherheits-, Incident-Response- oder Penetrationstest-Teams beschränkt, und die Nutzung pro Mitarbeiter wird verfolgt. Regierungen, Betreiber kritischer Infrastrukturen und Kerntechnologieplattformen können sich auf der Fairwind-Programmseite bewerben.
Als Nächstes: kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten. Google wird zuerst „Feedback von frühen Testern sammeln, während wir die Schutzmechanismen iterieren“, und nimmt am freiwilligen Vorabzugangsverfahren der US-Regierung teil. Der Abschnitt „Rollout“ im Launch-Post ist mit „Rollout in Kürze“ betitelt und gibt kein Datum an. Unser Leitfaden für Veröffentlichungsdatum und Zugang verfolgt jede Phase.
Noch nicht: alle anderen. Stand 1. Oktober zeigen die Gemini API-Modellseite, die Preisseite, die Gemini-App, Antigravity und OpenRouter kein Argon. Ein Google AI Ultra-Plan (ab 99,99 $ pro Monat in den USA) ist ein Verbraucherabonnement, kein API-Schlüssel, und Google hat nicht gesagt, welche Ultra-Stufe Argon zuerst erhält. Es gibt keinen kostenlosen Weg; ist Gemini 4 Argon kostenlos behandelt, was Sie stattdessen verwenden können.
Gemini 4 Argon Preise
| Token-Typ | Einführung (pro 1 Mio.) | Nach Einführung (pro 1 Mio.) |
|---|---|---|
| Eingabe | 2,00 $ | 4,00 $ |
| Zwischengespeicherte Eingabe (95 % Rabatt) | 0,10 $ | 0,20 $ |
| Ausgabe | 10,00 $ | 20,00 $ |
| Eine vollständige Antwort von 1 Mio. Tokens, nur Ausgabe | 10,00 $ | 20,00 $ |
Google hat nicht gesagt, wie lange die Einführungsphase dauert. Zu Standardpreisen kostet Argon genau so viel wie Claude Opus 5.5; zu Einführungspreisen entspricht es GPT-6.1 Sol und Claude Sonnet 5.5. Die zwischengespeicherten Preise sind arithmetisch aus Googles 95%-Regel abgeleitet. Durchgerechnete Szenarien finden Sie unter Gemini 4 Argon Preise.
Das 1-Mio.-Ausgabelimit
Google sagt, es „erweitert das Ausgabelimit des Modells erheblich auf branchenführende 1 Million Tokens, von zuvor 64K Tokens.“ Das Argument: Mit der Möglichkeit, Hunderttausende von Tokens in einer einzigen Trajektorie zu generieren, kann das Modell komplexe Probleme in einem Zug bearbeiten. Zum Vergleich: GPT-6 Astra, Claude Opus 5.5 und Claude Fable 5.1 deckeln die synchrone Ausgabe jeweils auf 128K.
Zwei Vorbehalte. Dies ist ein Ausgabelimit, kein Kontextfenster; Google hat das Eingabefenster nicht veröffentlicht. Und während Google sagt, dass Argons Ausgabelimit 1 Mio. Tokens beträgt, listet mindestens ein Drittanbieter-Evaluator, Vals AI, eine maximale Ausgabe von 262K für die von ihm getestete Konfiguration. Planen Sie mit dem Limit, das Ihr Endpunkt meldet. Unser Leitfaden zu Argons 1-Mio.-Ausgabe-Tokens behandelt Timeouts, Streaming und Kostenlimits.
Gemini 4 Argon Benchmarks: die Schlagzeile
Alle untenstehenden Zahlen stammen aus Googles Tabelle. Argons Scores sind von Google berichtet, einige selbst berechnet und einige von Bestenlisten wie Vals AI; Konkurrenten-Scores sind größtenteils die eigenen der Anbieter oder öffentliche Bestenlisten-Ergebnisse, und die Testumgebungen unterscheiden sich. Nach unserer Neuberechnung führt Argon in 13 von 19 Zeilen klar, ist in einer gleichauf und liegt in fünf zurück.
| Benchmark | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index | 68.9% | 63.1% | 65.8% | 67.0% |
| DeepSWE v1.1 | 77.9% | 74.1% | 67.4% | 74.2% |
| GraphWalks 256K bis 1M (F1) | 84.2% | 71.8% | 65.0% | 66.8% |
| FrontierSWE v2 | 55.0% | 65.5% | 56.3% | 62.3% |
| Terminal-bench 4.0 | 57.4% | 58.2% | 57.9% | 66.4% |
| PostTrainBench | 45.3% | 44.3% | 40.2% | 49.3% |
Die fünf Reihen, die Argon verliert: FrontierSWE v2, Terminal-Bench Science 0.1 und OSWorld-2.0 (an Astra), sowie Terminal-bench 4.0 und PostTrainBench (an Opus 5.5).
Dritte Parteien stufen Argon als wegweisend ein, jedoch ohne klaren Vorsprung. Artificial Analysis bewertet es mit 53 auf ihrem Intelligence Index, gleichauf mit GPT-6 Astra und Claude Fable 5.1 und hinter Claude Opus 5.5 mit 58 und Claude Sonnet 5.5 mit 56 (maximale Einstellungen); Vals rangiert es als erstes von 41 Modellen auf dem Vals Index. Alle 19 Reihen und Googles Methodiknotizen finden Sie in Gemini 4 Argon Benchmarks.

Cyber-Verteidigung in einem Absatz
Google sagt: „Argon kann kritische Software-Schwachstellen autonom finden, validieren und patchen.“ Für vertrauenswürdige Verteidiger und seine internen Teams fügt es hinzu: „Wir werden Argon ohne Cyber-Schutzmaßnahmen veröffentlichen, damit sie seine vollen Fähigkeiten zur Cybersicherheitsverteidigung auf höchstem Niveau nutzen können.“ Auf DeepMinds Cyber-Seite erzielt Argon 85,8 % bei der Entdeckung realer Schwachstellen (Gemini 3.8 Flash Cyber: 71,0 %), ist gleichauf mit Grok 4.7 und GPT-6 Astra mit 68 % bei CWE-bench v1 und weist die niedrigste Erfolgsrate für Gray Swan indirekte Prompt-Injection-Angriffe in der Tabelle auf, nämlich 0,7 % bei k=15. Sehen Sie, was Argons Cyber-Release für die APIs bedeutet, die Sie betreiben, und seinen Vorgänger, Gemini 3.8 Flash Cyber.
Was Sie jetzt als Entwickler tun können
Bauen Sie auf einem Modell auf, das Sie heute aufrufen können, und halten Sie den Modellnamen in einer Variable. gemini-3.8-flash ist der Platzhalter: stabil, 1.048.576 Eingabe- und 65.536 Ausgabe-Tokens, ein kostenloser Tier und 0,75 $/3,75 $ pro Million bis zum 31. Dezember 2026. Googles Interactions API-Dokumentation besagt, dass „alle neuen Modelle, multimodalen Funktionen, Tools und agentischen Funktionen über die Interactions API gestartet werden“, also schreiben Sie dagegen an. Google hat Argons Modell-ID nicht veröffentlicht, sodass Sie die Variable ändern, sobald es verfügbar ist.
MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"
curl -s "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "'"$MODEL"'",
"input": "List the breaking changes in this OpenAPI diff.",
"generation_config": {"thinking_level": "medium"}
}'
Speichern Sie in Apidog denselben Aufruf als Anfrage mit GEMINI_API_KEY und GEMINI_MODEL als Umgebungsvariablen und überprüfen Sie dann die Token-Anzahlen im usage-Objekt der Antwort (total_output_tokens plus total_thought_tokens, da das Denken als Ausgabe abgerechnet wird), damit eine außer Kontrolle geratene Antwort den Test fehlschlagen lässt. Behalten Sie die 3.8 Flash-Antwort als Ihre Baseline. Wenn Argons ID in der Modellliste erscheint, ändern Sie GEMINI_MODEL, führen Sie es erneut aus und vergleichen Sie.
Formen der Anfrage finden Sie im Gemini 4 Argon API-Leitfaden. Um zu entscheiden, ob sich das Warten überhaupt lohnt, lesen Sie Argon vs. Gemini 3.8 Flash.
FAQ
Kann ich Gemini 4 Argon in der Gemini API verwenden? Noch nicht. Nur einige Fairwind-Partner haben es; die öffentliche Modellliste enthält es nicht.
Was ist die Gemini 4 Argon Modell-ID? Google hat keine veröffentlicht. Im Umlauf befindliche Strings, einschließlich Evaluator-Slugs, sind Platzhalter Dritter, also nicht fest codieren.
Wann ist die Gemini 4 Argon Veröffentlichung für Entwickler? Google hat kein Datum genannt. Kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten kommen zuerst, „so bald wie möglich.“
Ist Gemini 4 Argon besser als GPT-6 Astra und Claude Opus 5.5? Es führt die meisten Zeilen in Googles Tabelle an, ist aber bei Artificial Analysis gleichauf mit Astra und liegt dort hinter Opus 5.5. Für die Rivalen nach ihren eigenen Maßstäben siehe was ist Claude Opus 5.5 und unseren GPT-6 Astra API-Leitfaden.
Hat Gemini 4 Argon ein 1-Mio.-Kontextfenster? Google hat sich nicht dazu geäußert. 1 Mio. ist das Ausgabelimit; seine Long-Context-Evaluierung verwendete Prompts von bis zu 1 Mio. Tokens, was keine veröffentlichte Spezifikation ist.
Bereiten Sie sich vor, bevor Argon verfügbar wird
Argon ist angekündigt, bepreist und benchmarkt, aber Sie können es noch nicht aufrufen. Bauen Sie auf Gemini 3.8 Flash mit unserem Gemini 3.8 Flash API-Leitfaden auf, halten Sie das Modell in einer Variable und fügen Sie jeder Anfrage eine Token-Behauptung hinzu. Um die Anfrage, Umgebung und Baseline für den Wechsel bereitzuhalten, laden Sie Apidog herunter und richten Sie es noch heute ein.
