Gemini Omni 1.1 Flash Kosten: Was eine Sekunde Video tatsächlich kostet

Videoausgabe kostet 17,50 $ pro 1 Million Tokens und 5.792 Tokens pro Sekunde bei 720p, sodass eine Sekunde etwa 0,10 $ kostet. Die vollständige Preisliste, die 360p-Entwurfsoption und eine monatliche Schätzung.

Ashley Innocent

Ashley Innocent

28 August 2026

Gemini Omni 1.1 Flash Kosten: Was eine Sekunde Video tatsächlich kostet

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Eine Sekunde 720p-Video von Gemini Omni 1.1 Flash kostet etwa $0.10. Das ist der Wert, mit dem man planen sollte, und es ist der Wert, den Googles eigene Preisseite angibt. Es gibt keine kostenlose Stufe, daher wird der erste Clip, den Sie beim Lesen der Dokumentation generieren, Ihrem Konto belastet.

Der interessante Teil ist, wie Google auf diesen Betrag kommt, da das Abrechnungsmodell tokenbasiert statt zeitbasiert ist. Sobald Sie den Mechanismus verstanden haben, werden die Kostenhebel offensichtlich, und einer davon (Entwürfe in 360p erstellen) reduziert Ihre Iterationsausgaben um zwei Drittel.

Die Preisliste

Posten Preis
Eingabe (Text, Bild, Video, Audio) $1.50 pro 1 Million Tokens
Textausgabe $9.00 pro 1 Million Tokens
Videoausgabe $17.50 pro 1 Million Tokens
Kostenlose Stufe Keine

Diese Tarife gelten für gemini-omni-1.1-flash, das am 27. August 2026 veröffentlichte GA-Modell, und für den auslaufenden gemini-omni-flash-preview-Endpunkt. Sehen Sie sich an, was in der GA-Version enthalten war, um die Funktionsseite zu erfahren.

Wie Videoausgabe zu Tokens wird

Google rechnet Video auf die gleiche Weise ab wie Text: nach Ausgabe-Tokens. Eine Sekunde 720p-Video kostet 5.792 Ausgabe-Tokens. Führen Sie die Multiplikation durch:

5.792 Tokens x ($17.50 / 1.000.000) = $0.1014 pro Sekunde

Ein 10-sekündiger 720p-Clip kostet also ungefähr $1.01. Eine 40-sekündige Szene, die durch vier Erweiterungsaufrufe erstellt wurde, kostet ungefähr $4.06, plus die Eingabe-Tokens für den vorherigen Kontext, den jede Runde liest.

Die Eingabe ist im Vergleich günstig. Bei $1.50 pro Million fallen die Referenzbilder und -videos, die Sie anhängen, neben der Ausgabe kaum ins Gewicht. Optimieren Sie nicht Ihre Prompt-Länge. Optimieren Sie, wie viele Sekunden Video Sie in welcher Auflösung generieren.

Der 360p-Hebel

Google generiert 360p-Vorschauen zu einem Drittel der Kosten von 720p und bis zu 60 % schneller. Das bedeutet, ein 10-sekündiger Entwurf kostet etwa $0.34 statt $1.01.

Das bedeutet in der Praxis Folgendes: Die Prompt-Iteration bei Videomodellen ist brutal: Selten trifft man den gewünschten Shot beim ersten Versuch, und jeder fehlgeschlagene Versuch wird voll berechnet. Eine realistische Sitzung sieht nach zwölf Versuchen aus, bevor ein erfolgreicher dabei ist.

Workflow 12 Entwürfe 1 endgültiges Rendering Gesamt
Alles in 720p $12.17 $1.01 $13.18
Entwurf in 360p, Finale in 720p $4.06 $1.01 $5.07

Dieselbe Ausgabe, 62 % weniger Ausgaben, und die Entwürfe kommen schneller zurück, sodass Sie die zwölf Versuche schneller durchlaufen. Setzen Sie resolution auf 360p in response_format, während Sie iterieren, und erhöhen Sie es erst, wenn der Prompt stimmt. Der API-Leitfaden zeigt die Anfrageform.

Die 1080p- und 4K-Stufen sind Upscales der generierten Frames und keine nativen Renderings, und sie werden über dem 720p-Tarif abgerechnet. Überprüfen Sie die aktuellen Pro-Sekunden-Werte auf der Preisseite von Google, bevor Sie eine 4K-Pipeline budgetieren, da diese beiden Stufen mit der GA-Version eingeführt wurden und die veröffentlichten Tarife maßgebend sind.

Was der Erweiterungs-Workflow kostet

Die Szenenerweiterung ist der Punkt, an dem Budgets aus dem Ruder laufen, denn ein 40-sekündiges Video ist nicht eine einzige Anfrage. Es ist eine Generierung plus drei Erweiterungsaufrufe, wobei jeder seine eigenen 10 Sekunden Ausgabe plus den vorherigen Kontext, den er als Eingabe liest, abrechnet.

In 720p kostet eine vollständige 40-sekündige Szene etwa $4.06 an Ausgabe, und jeder Versuch, der von der Geschichte abweicht, bedeutet eine Neuerstellung ab dem Segment, das unterbrochen wurde. Entwerfen Sie den gesamten Ablauf zuerst in 360p für etwa $1.35, bestätigen Sie, dass die Geschichte in allen vier Segmenten stimmt, und rendern Sie dann neu. Der Leitfaden zur Szenenerweiterung behandelt, wo Erweiterungen tendenziell fehlschlagen.

Vergleich mit Veo 3.1

Beide Modelle liegen hinter demselben Gemini API-Schlüssel, was den Preisunterschied leicht übersehen lässt.

Modell 720p pro Sekunde 4K pro Sekunde Kostenlose Stufe
Gemini Omni 1.1 Flash ~$0.10 Upscale-Stufe, siehe Preisseite Nein
Veo 3.1 $0.40 $0.60 Nein
Veo 3.1 Fast $0.10 $0.30 Nein
Veo 3.1 Lite $0.05 Nicht verfügbar Nein

Standard Veo 3.1 kostet etwa viermal so viel wie eine Omni-Sekunde in 720p. Veo 3.1 Lite unterbietet Omni. Aber der Preis pro Sekunde ist nicht der gesamte Vergleich. Veo generiert native Audio und erweitert viel weiter (7 Sekunden auf einmal, bis zu 148 Sekunden), während Omni Ihnen die konversationelle Bearbeitungsschleife bietet, für die Veo kein Äquivalent hat. Der vollständige Vergleich erklärt, welches Modell für welchen Job geeignet ist. Wenn Sie bereits Veo verwenden, gilt dieser Integrationsleitfaden weiterhin.

Drei Wege, wie Teams bei dieser API zu viel ausgeben

Neuerstellung in voller Auflösung, um eine kleine Änderung zu überprüfen. Wenn Sie eine Klausel im Prompt anpassen, zeigt Ihnen der 360p-Durchlauf, ob die Änderung funktioniert hat. Der 720p-Durchlauf ist für die Version, die Sie ausliefern.

Produktionsgenerierung von Inhalten, die Sie cachen könnten. Die Videoausgabe ist ausreichend deterministisch, um sie wiederzuverwenden, und bei $0.10 pro Sekunde zahlt sich der Cache sofort aus. Speichern Sie die generierte Datei und verknüpfen Sie sie mit dem Prompt plus Parametern. Das zweimalige Regenerieren desselben Clips ist ein reiner Verlust.

Erneutes Versuchen bei Timeout ohne Überprüfung. Die Videoerzeugung ist langsam, und ein Client-Timeout bedeutet nicht, dass die Generierung fehlgeschlagen ist. Wenn Ihre Wiederholungslogik bei einem Timeout ausgelöst wird, können Sie zweimal für einen Clip bezahlen. Erhöhen Sie den Timeout und überprüfen Sie vor dem erneuten Versuch, ob eine Interaktion abgeschlossen wurde.

Der letzte Punkt sollte unbedingt beachtet werden, bevor er in die Produktion geht. Speichern Sie die Anfrage in Apidog mit einem realistischen Timeout, prüfen Sie die Antwortform und führen Sie sie bewusst aus, anstatt eine Wiederholungsschleife die Kosten für Sie entdecken zu lassen. Das Einrichten einer Ausgabenwarnung in der Google Cloud-Abrechnung ist die andere Hälfte dieses Sicherheitsnetzes.

Schätzung einer monatlichen Rechnung

Gehen Sie von Sekunden fertigen Videos aus und multiplizieren Sie dann mit Ihrem Entwurfsverhältnis.

monatliche Kosten = fertige_Sekunden x $0.10
             + entwurfs_Sekunden x $0.034

Ein Team, das monatlich 5 Minuten fertiges 720p-Video liefert, mit einem 10:1-Entwurf-zu-Finale-Verhältnis in 360p:

300 fertige Sekunden x $0.10       = $30.00
3.000 entwurfs Sekunden x $0.034       = $102.00
                                     -------
                                     $132.00

Beachten Sie, wohin das Geld fließt. Entwürfe dominieren, selbst zu einem Drittel des Preises, da Sie zehnmal mehr entwerfen, als Sie ausliefern. Wenn diese Zahl gesenkt werden muss, liegt der Hebel in weniger Versuchen pro erfolgreichem Ergebnis (bessere Prompts, Keyframe-Steuerung zur Beschränkung der Ausgabe), nicht in einem günstigeren finalen Rendering.

FAQ

Ist Gemini Omni 1.1 Flash kostenlos? Nicht über die API. Es gibt keine kostenlose Stufe für Omni, obwohl das Modell auf YouTube Shorts und YouTube Create kostenlos ist; die Zusammenfassung des kostenlosen Zugangs deckt diese Wege ab. Googles Textmodelle wie Gemini 3.6 Flash bieten weiterhin eine ratenbegrenzte kostenlose Spur über AI Studio an.

Wie viel kostet ein 10-sekündiges Video? Ungefähr $1.01 in 720p oder etwa $0.34 in 360p.

Warum wird Video in Tokens abgerechnet? Google bepreist alle Modellausgaben in Tokens, um Konsistenz zu gewährleisten. Die Videoausgabe wird mit 5.792 Tokens pro Sekunde in 720p umgerechnet und zum Preis von $17.50 pro Million Video-Ausgabe-Tokens abgerechnet.

Kosten Eingabebilder und Referenzclips extra? Ja, zu $1.50 pro Million Eingabe-Tokens, was im Vergleich zur Videoausgabe gering ist. Referenzmedien sind nicht der Posten, der optimiert werden sollte.

Lohnt sich 4K? Nur für endgültige Lieferobjekte. 1080p und 4K sind Upscales, sie fügen also keine Details hinzu, die das Modell nicht generiert hat. Sie erhöhen die Dateigröße und die Kosten.

Wird eine fehlgeschlagene Generierung trotzdem abgerechnet? Eine Generierung, die Video zurückgibt, wird abgerechnet. Ablehnungen durch Inhaltsfilter und Fehler, die keine Ausgabe erzeugen, sollten nicht abgerechnet werden, aber beobachten Sie Ihr Abrechnungs-Dashboard in der ersten Woche jeder neuen Pipeline, anstatt Annahmen zu treffen.

Die Wirtschaftlichkeit belohnt hier mehr Disziplin als Cleverness. Entwerfen Sie günstig, cachen Sie aggressiv, begrenzen Sie Ihre Timeouts und bewahren Sie eine gespeicherte Anfrage pro Aufgabentyp auf, damit Sie den Tag bemerken, an dem ein Modell-Update ändert, was Sie für Ihre $0.10 erhalten. Laden Sie Apidog herunter, wenn Sie diese Überprüfung lieber laufen lassen möchten, bevor Ihnen die Rechnung die Kosten mitteilt.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen