Was ist Gemini 4 Argon

Was ist Gemini 4 Argon? Googles bahnbrechendes Modell: Heute nur über Fairwind verfügbar, Einführungspreis $2/10, danach $4/20, 1M Ausgabe, und wie es sich im Benchmark gegen Astra und Opus 5.5 schlägt.

Ashley Innocent

Ashley Innocent

2 October 2026

Was ist Gemini 4 Argon

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Gemini 4 Argon ist Googles neues Vorzeigemodell, das am 30. September 2026 angekündigt wurde und heute nur den Verteidigern des Fairwind-Programms zur Verfügung steht, einer überprüften Gruppe von Cyber-Verteidigungspartnern. Google bepreist es in einer Einführungsphase mit 2 $ pro Million Eingabe-Tokens und 10 $ pro Million Ausgabe-Tokens, danach mit 4 $ bzw. 20 $, und erhöht das Ausgabelimit auf 1 Million Tokens pro Antwort. Es gibt noch keine öffentliche API, keine veröffentlichte Modell-ID und kein Veröffentlichungsdatum.

Dieser Leitfaden ist das Zentrum unserer Argon-Berichterstattung: was Google bestätigt hat und was nicht, wo Argon in der Gemini-Reihe steht, wer es als Nächstes erhält, was es kostet, wie es abschneidet und was Sie heute damit aufbauen können. Sie wählen gerade ein Modell aus? Lesen Sie unseren Vergleich Gemini 4 Argon vs. GPT-6 Astra vs. Claude Opus 5.5. Wenn Sie Modell-APIs in Apidog testen, zeigt der letzte Abschnitt, wie Sie den Wechsel zu Argon mit einer einzigen Wertänderung vornehmen können.

Was Google bestätigt hat vs. was nicht

Die meisten frühen Berichte vermischen Googles Aussagen mit Spekulationen Dritter. Hier ist die Aufteilung, basierend auf dem Launch-Post und Googles Evaluierungsmethodik.

Punkt Status Was wir wissen
Ankündigung Bestätigt 30. September 2026, von Koray Kavukcuoglu von Google DeepMind
Zugang heute Bestätigt Einige Fairwind-Programmpartner
Als Nächstes Bestätigt, undatiert Kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten
Preis Bestätigt 2 $/10 $ Einführung, dann 4 $/20 $ pro 1 Mio. Tokens; zwischengespeicherte Eingabe 95 % Rabatt
Ausgabelimit Bestätigt 1 Mio. Tokens, gegenüber 64K
Benchmarks Bestätigt, von Google berichtet Eine 19-zeilige Tabelle plus ein Methodik-PDF
Modell-ID Nicht veröffentlicht Online-Strings sind Platzhalter Dritter
Eingabe-Kontextfenster Nicht veröffentlicht Googles Long-Context-Evaluierung verwendete Prompts von bis zu 1 Mio. Tokens
Wissensstand Nicht veröffentlicht Nichts von Google
Dauer der Einführungsphase Nicht veröffentlicht Kein Datum für den Wechsel zu 4 $/20 $
Ratenlimits, Free Tier Nicht veröffentlicht Nichts von Google
Veröffentlichungsdatum Nicht veröffentlicht „So bald wie möglich“

Wenn eine Website ein Kontextfenster, einen Modellstring oder eine Geschwindigkeitsangabe für Argon auflistet, behandeln Sie diese als unbestätigt, bis Googles eigene Dokumente dies zeigen.

Was Gemini 4 Argon ist und wo es steht

Argon ist das einzige bisher angekündigte Gemini 4 Modell und die neue Spitze von Googles Produktpalette. Google nennt es „unser neues Vorzeigemodell“, das „entwickelt wurde, um tiefgreifende Schlussfolgerungen über komplexe, langwierige Arbeitsabläufe hinweg aufrechtzuerhalten“, und beansprucht Spitzenleistungen in den Bereichen Softwareentwicklung, Unternehmenswissensarbeit wie Recht und Finanzen sowie Cybersicherheitsverteidigung. Ein Google-Sprecher teilte Reuters mit, dass Argon größer ist als die bisherige Linie der „Pro“-Modelle des Unternehmens.

Bisher war das Top-Gemini-API-Modell gemini-3.1-pro-preview, das sich noch in der Vorschau befindet: 1.048.576 Eingabe-Tokens, 65.536 Ausgabe-Tokens (die „64K“, die Argon ersetzt) und 2 $ Eingabe / 12 $ Ausgabe pro Million für Prompts bis zu 200K. Argon’s Einführungspreis von 10 $ für die Ausgabe unterbietet dies. Google hat nicht gesagt, ob Argon eine separate Long-Prompt-Stufe wie 3.1 Pro erhält oder ob weitere Gemini 4 Modelle folgen werden. Reuters beschrieb die Veröffentlichung als „nach Monaten der Verzögerungen“, eine Anspielung auf die Gemini 3.5 Pro-Veröffentlichung, die für Juni versprochen und später fallengelassen wurde.

Google betreibt Argon bereits intern. Es sagt, dass Tausende von Mitarbeitern es zum Codieren, Forschen und Schreiben verwenden, dass Argon-Agenten über 300 TiB Flotten-Speicher freigesetzt haben und dass C- und C++-Code zu Rust migriert wird, bis zu über 800K Zeilen für den Fuchsia Zircon-Kernel, wobei diese Umschreibungen noch vor der Produktion geprüft werden.

Wer Gemini 4 Argon heute nutzen kann und wer als Nächstes

Heute: eine Teilmenge der Fairwind-Partner. Fairwind ist Googles Cyber-Verteidigungsprogramm mit eingeschränktem Zugang und über 650 Partnern, aber nur „einige Fairwind-Programmpartner“ erhalten Argon, eigenständig oder innerhalb von CodeMender, Googles Code-Sicherheitsagenten. Direkt „als verwaltetes Modell auf Gemini Enterprise“ zugegriffen, unterstützt es Zero Data Retention. Partner müssen sich zu Phishing-resistenter MFA verpflichten, der Zugang ist auf interne Sicherheits-, Incident-Response- oder Penetrationstest-Teams beschränkt, und die Nutzung pro Mitarbeiter wird verfolgt. Regierungen, Betreiber kritischer Infrastrukturen und Kerntechnologieplattformen können sich auf der Fairwind-Programmseite bewerben.

Als Nächstes: kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten. Google wird zuerst „Feedback von frühen Testern sammeln, während wir die Schutzmechanismen iterieren“, und nimmt am freiwilligen Vorabzugangsverfahren der US-Regierung teil. Der Abschnitt „Rollout“ im Launch-Post ist mit „Rollout in Kürze“ betitelt und gibt kein Datum an. Unser Leitfaden für Veröffentlichungsdatum und Zugang verfolgt jede Phase.

Noch nicht: alle anderen. Stand 1. Oktober zeigen die Gemini API-Modellseite, die Preisseite, die Gemini-App, Antigravity und OpenRouter kein Argon. Ein Google AI Ultra-Plan (ab 99,99 $ pro Monat in den USA) ist ein Verbraucherabonnement, kein API-Schlüssel, und Google hat nicht gesagt, welche Ultra-Stufe Argon zuerst erhält. Es gibt keinen kostenlosen Weg; ist Gemini 4 Argon kostenlos behandelt, was Sie stattdessen verwenden können.

Gemini 4 Argon Preise

Token-Typ Einführung (pro 1 Mio.) Nach Einführung (pro 1 Mio.)
Eingabe 2,00 $ 4,00 $
Zwischengespeicherte Eingabe (95 % Rabatt) 0,10 $ 0,20 $
Ausgabe 10,00 $ 20,00 $
Eine vollständige Antwort von 1 Mio. Tokens, nur Ausgabe 10,00 $ 20,00 $

Google hat nicht gesagt, wie lange die Einführungsphase dauert. Zu Standardpreisen kostet Argon genau so viel wie Claude Opus 5.5; zu Einführungspreisen entspricht es GPT-6.1 Sol und Claude Sonnet 5.5. Die zwischengespeicherten Preise sind arithmetisch aus Googles 95%-Regel abgeleitet. Durchgerechnete Szenarien finden Sie unter Gemini 4 Argon Preise.

Das 1-Mio.-Ausgabelimit

Google sagt, es „erweitert das Ausgabelimit des Modells erheblich auf branchenführende 1 Million Tokens, von zuvor 64K Tokens.“ Das Argument: Mit der Möglichkeit, Hunderttausende von Tokens in einer einzigen Trajektorie zu generieren, kann das Modell komplexe Probleme in einem Zug bearbeiten. Zum Vergleich: GPT-6 Astra, Claude Opus 5.5 und Claude Fable 5.1 deckeln die synchrone Ausgabe jeweils auf 128K.

Zwei Vorbehalte. Dies ist ein Ausgabelimit, kein Kontextfenster; Google hat das Eingabefenster nicht veröffentlicht. Und während Google sagt, dass Argons Ausgabelimit 1 Mio. Tokens beträgt, listet mindestens ein Drittanbieter-Evaluator, Vals AI, eine maximale Ausgabe von 262K für die von ihm getestete Konfiguration. Planen Sie mit dem Limit, das Ihr Endpunkt meldet. Unser Leitfaden zu Argons 1-Mio.-Ausgabe-Tokens behandelt Timeouts, Streaming und Kostenlimits.

Gemini 4 Argon Benchmarks: die Schlagzeile

Alle untenstehenden Zahlen stammen aus Googles Tabelle. Argons Scores sind von Google berichtet, einige selbst berechnet und einige von Bestenlisten wie Vals AI; Konkurrenten-Scores sind größtenteils die eigenen der Anbieter oder öffentliche Bestenlisten-Ergebnisse, und die Testumgebungen unterscheiden sich. Nach unserer Neuberechnung führt Argon in 13 von 19 Zeilen klar, ist in einer gleichauf und liegt in fünf zurück.

Benchmark Gemini 4 Argon GPT-6 Astra Claude Fable 5.1 Claude Opus 5.5
Vals Index 68.9% 63.1% 65.8% 67.0%
DeepSWE v1.1 77.9% 74.1% 67.4% 74.2%
GraphWalks 256K bis 1M (F1) 84.2% 71.8% 65.0% 66.8%
FrontierSWE v2 55.0% 65.5% 56.3% 62.3%
Terminal-bench 4.0 57.4% 58.2% 57.9% 66.4%
PostTrainBench 45.3% 44.3% 40.2% 49.3%

Die fünf Reihen, die Argon verliert: FrontierSWE v2, Terminal-Bench Science 0.1 und OSWorld-2.0 (an Astra), sowie Terminal-bench 4.0 und PostTrainBench (an Opus 5.5).

Dritte Parteien stufen Argon als wegweisend ein, jedoch ohne klaren Vorsprung. Artificial Analysis bewertet es mit 53 auf ihrem Intelligence Index, gleichauf mit GPT-6 Astra und Claude Fable 5.1 und hinter Claude Opus 5.5 mit 58 und Claude Sonnet 5.5 mit 56 (maximale Einstellungen); Vals rangiert es als erstes von 41 Modellen auf dem Vals Index. Alle 19 Reihen und Googles Methodiknotizen finden Sie in Gemini 4 Argon Benchmarks.

Cyber-Verteidigung in einem Absatz

Google sagt: „Argon kann kritische Software-Schwachstellen autonom finden, validieren und patchen.“ Für vertrauenswürdige Verteidiger und seine internen Teams fügt es hinzu: „Wir werden Argon ohne Cyber-Schutzmaßnahmen veröffentlichen, damit sie seine vollen Fähigkeiten zur Cybersicherheitsverteidigung auf höchstem Niveau nutzen können.“ Auf DeepMinds Cyber-Seite erzielt Argon 85,8 % bei der Entdeckung realer Schwachstellen (Gemini 3.8 Flash Cyber: 71,0 %), ist gleichauf mit Grok 4.7 und GPT-6 Astra mit 68 % bei CWE-bench v1 und weist die niedrigste Erfolgsrate für Gray Swan indirekte Prompt-Injection-Angriffe in der Tabelle auf, nämlich 0,7 % bei k=15. Sehen Sie, was Argons Cyber-Release für die APIs bedeutet, die Sie betreiben, und seinen Vorgänger, Gemini 3.8 Flash Cyber.

Was Sie jetzt als Entwickler tun können

Bauen Sie auf einem Modell auf, das Sie heute aufrufen können, und halten Sie den Modellnamen in einer Variable. gemini-3.8-flash ist der Platzhalter: stabil, 1.048.576 Eingabe- und 65.536 Ausgabe-Tokens, ein kostenloser Tier und 0,75 $/3,75 $ pro Million bis zum 31. Dezember 2026. Googles Interactions API-Dokumentation besagt, dass „alle neuen Modelle, multimodalen Funktionen, Tools und agentischen Funktionen über die Interactions API gestartet werden“, also schreiben Sie dagegen an. Google hat Argons Modell-ID nicht veröffentlicht, sodass Sie die Variable ändern, sobald es verfügbar ist.

MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"

curl -s "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "'"$MODEL"'",
    "input": "List the breaking changes in this OpenAPI diff.",
    "generation_config": {"thinking_level": "medium"}
  }'

Speichern Sie in Apidog denselben Aufruf als Anfrage mit GEMINI_API_KEY und GEMINI_MODEL als Umgebungsvariablen und überprüfen Sie dann die Token-Anzahlen im usage-Objekt der Antwort (total_output_tokens plus total_thought_tokens, da das Denken als Ausgabe abgerechnet wird), damit eine außer Kontrolle geratene Antwort den Test fehlschlagen lässt. Behalten Sie die 3.8 Flash-Antwort als Ihre Baseline. Wenn Argons ID in der Modellliste erscheint, ändern Sie GEMINI_MODEL, führen Sie es erneut aus und vergleichen Sie.

Formen der Anfrage finden Sie im Gemini 4 Argon API-Leitfaden. Um zu entscheiden, ob sich das Warten überhaupt lohnt, lesen Sie Argon vs. Gemini 3.8 Flash.

FAQ

Kann ich Gemini 4 Argon in der Gemini API verwenden? Noch nicht. Nur einige Fairwind-Partner haben es; die öffentliche Modellliste enthält es nicht.

Was ist die Gemini 4 Argon Modell-ID? Google hat keine veröffentlicht. Im Umlauf befindliche Strings, einschließlich Evaluator-Slugs, sind Platzhalter Dritter, also nicht fest codieren.

Wann ist die Gemini 4 Argon Veröffentlichung für Entwickler? Google hat kein Datum genannt. Kostenpflichtige API-Kunden und Google AI Ultra-Abonnenten kommen zuerst, „so bald wie möglich.“

Ist Gemini 4 Argon besser als GPT-6 Astra und Claude Opus 5.5? Es führt die meisten Zeilen in Googles Tabelle an, ist aber bei Artificial Analysis gleichauf mit Astra und liegt dort hinter Opus 5.5. Für die Rivalen nach ihren eigenen Maßstäben siehe was ist Claude Opus 5.5 und unseren GPT-6 Astra API-Leitfaden.

Hat Gemini 4 Argon ein 1-Mio.-Kontextfenster? Google hat sich nicht dazu geäußert. 1 Mio. ist das Ausgabelimit; seine Long-Context-Evaluierung verwendete Prompts von bis zu 1 Mio. Tokens, was keine veröffentlichte Spezifikation ist.

Bereiten Sie sich vor, bevor Argon verfügbar wird

Argon ist angekündigt, bepreist und benchmarkt, aber Sie können es noch nicht aufrufen. Bauen Sie auf Gemini 3.8 Flash mit unserem Gemini 3.8 Flash API-Leitfaden auf, halten Sie das Modell in einer Variable und fügen Sie jeder Anfrage eine Token-Behauptung hinzu. Um die Anfrage, Umgebung und Baseline für den Wechsel bereitzuhalten, laden Sie Apidog herunter und richten Sie es noch heute ein.

button

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen