OpenAI senkt GPT-5.6 API Preise drastisch: Luna 80%, Terra 20% günstiger (Neue Preisübersicht)

OpenAI senkte am 30. Juli 2026 die Preise für die GPT-5.6 API: Luna fiel um 80 % auf 0,20 $/1,20 $ pro Million Tokens, Terra um 20 % auf 2 $/12 $. Die vollständige alte und neue Preisliste, warum OpenAI die Preise senkte und wie Sie Ihre Workloads umleiten können.

Ashley Innocent

Ashley Innocent

31 July 2026

OpenAI senkt GPT-5.6 API Preise drastisch: Luna 80%, Terra 20% günstiger (Neue Preisübersicht)

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

OpenAI senkte am 30. Juli 2026 die API-Preise für zwei seiner drei GPT-5.6-Modelle. GPT-5.6 Luna kostet jetzt 80 % weniger: 0,20 $ pro Million Eingabe-Tokens und 1,20 $ pro Million Ausgabe-Tokens. GPT-5.6 Terra sank um 20 % auf 2 $ für Eingabe und 12 $ für Ausgabe. GPT-5.6 Sol, das Flaggschiff-Argumentationsmodell, behält seine Preise von 5 $ und 30 $ bei, erhält aber einen neuen Fast-Modus, der 2,5x schneller läuft zum doppelten Standardpreis.

Wenn Sie Ihr Kostenmodell auf der Grundlage der GPT-5.6-Preise vom Starttag aufgebaut haben, sind diese Berechnungen jetzt veraltet. Dieser Beitrag behandelt die neue Preisliste, warum OpenAI die Preise gesenkt hat, wie die Zahlen im Vergleich zu Googles Gemini Flash-Tier abschneiden und was Sie diese Woche an Ihrem eigenen API-Routing ändern sollten. Und da der schnellste Weg, Modellkosten zu vergleichen, darin besteht, dieselbe Anfrage gegen jede Stufe zu testen, machen Tools wie Apidog es einfach, eine einzige Eingabeaufforderung gleichzeitig durch Sol, Terra und Luna zu senden und den Token-Verbrauch zu messen, bevor Sie sich festlegen.

App herunterladen

Die neue GPT-5.6 Preisliste

Hier ist die vollständige Vorher-Nachher-Übersicht, pro Million Tokens:

Modell Alter Input Neuer Input Alter Output Neuer Output Änderung
GPT-5.6 Sol $5.00 $5.00 $30.00 $30.00 Keine Änderung
GPT-5.6 Terra $2.50 $2.00 $15.00 $12.00 -20%
GPT-5.6 Luna $1.00 $0.20 $6.00 $1.20 -80%

Die neuen Preise traten am 30. Juli 2026 in Kraft und gelten für die Standard-API-Stufe. Die Spanne zwischen der obersten und untersten Stufe der Familie stieg von 5x bei der allgemeinen Verfügbarkeit am 9. Juli auf heute 25x. Diese Lücke verändert die Routing-Entscheidung. Vor drei Wochen sparte das Senden einer Aufgabe an Luna statt Sol 80 % der Rechnung. Jetzt spart es 96 %.

Prompt-Caching-Rabatte gelten weiterhin zusätzlich zu diesen Preisen. OpenAI hat in der Ankündigung keine separaten Preise für gecachte Eingaben für die neuen Luna- und Terra-Raten veröffentlicht. Überprüfen Sie daher die offizielle Preisseite, bevor Sie Abrechnungsprognosen aktualisieren, die von Cache-Lesevorgängen abhängen.

Was mit Sol passiert ist

Der Listenpreis von Sol ist unverändert, aber seine Geschwindigkeitsoptionen haben sich geändert. OpenAI hat einen Fast-Modus für Sol eingeführt: 2,5x schnellere Token-Generierung zum doppelten Standardpreis. Der Fast-Modus ersetzt die vorherige Priority-Processing-Stufe. Wenn Ihr Produktionsverkehr heute auf Priority Processing läuft, müssen Sie diese Konfiguration migrieren und die entsprechende Rechnungsposition erneut überprüfen.

Die praktische Interpretation: OpenAI segmentiert Sol nach Latenz anstatt es zu rabattieren. Teams, die Flaggschiff-Argumentation mit interaktiven Geschwindigkeiten benötigen, zahlen einen Premium-Preis dafür. Alle anderen leiten den Datenverkehr auf die günstigeren Modelle um, genau dorthin, wohin die Preissenkungen sie drängen.

Warum OpenAI die Preise gesenkt hat

OpenAI stellt die Preissenkungen als weitergegebene Effizienzgewinne dar und nicht als Lockvogelangebot. Die Ankündigung nennt vier Hebel:

Der letzte Punkt ist das Detail, das man sich merken sollte. OpenAI sagt, dass Sol Serving-Kernels autonom neu geschrieben hat, wodurch der End-to-End-Serving-Overhead um 20 % reduziert und die Effizienz der Token-Generierung um mehr als 15 % verbessert wurde. „Fortschrittliche Intelligenz reichlicher und erschwinglicher zu machen, ist das Herzstück der Mission von OpenAI“, sagte das Unternehmen in der Ankündigung. Was auch immer man von der Missionsformulierung halten mag, der Mechanismus ist konkret: Das Modell ist jetzt günstig genug zu bedienen, so dass OpenAI den Preis von Luna um 80 % senken und trotzdem die Marge schützen kann.

Es gibt auch einen offensichtlichen Wettbewerbsfaktor. Die Berichterstattung von VentureBeat interpretiert die Kürzung als direkte Reaktion auf Googles Flash-Tier. Lunas kombinierter Listenpreis (Eingabe plus Ausgabe) beträgt jetzt 1,40 $ pro Million Tokens und unterbietet damit sowohl Gemini 3.5 Flash-Lite mit 2,80 $ als auch Gemini 3.6 Flash mit 9 $. Das günstige Ende der Grenze ist dort, wo das Volumen liegt, und OpenAI will es zurückhaben.

Was die Preissenkung für Ihre Workloads bedeutet

Die 80%ige Luna-Senkung ist diejenige, die Architektur-Entscheidungen verändert, nicht die 20%ige Terra-Kürzung. Ein paar konkrete Verschiebungen:

So überprüfen Sie Ihre eigenen Zahlen

Verlassen Sie sich nicht blind auf die Prozentsätze; messen Sie Ihren tatsächlichen Traffic. Der Workflow, der Überraschungen frühzeitig erkennt:

  1. Ziehen Sie eine repräsentative Stichprobe von Produktions-Prompts.
  2. Senden Sie dieselben Anfragen an gpt-5.6-luna, gpt-5.6-terra und gpt-5.6-sol und erfassen Sie die Token-Anzahl pro Antwort.
  3. Multiplizieren Sie mit den neuen Preisen und vergleichen Sie die Qualität mit Ihrem eigenen Evaluierungs-Set.

Apidog beschleunigt Schritt 2: Definieren Sie den Chat-Completion-Endpunkt einmal, wechseln Sie die Modell-ID mit einer Umgebungsvariablen und führen Sie dasselbe Testszenario gegen alle drei Stufen aus. Der Antwort-Viewer zeigt den usage-Block pro Aufruf an, sodass Sie reale Input- und Output-Token-Zahlen anstelle von Schätzungen erhalten. Wenn Sie GPT-5.6 zum ersten Mal in eine App integrieren, führt Sie unser Leitfaden zur Nutzung der GPT-5.6 API durch die Authentifizierung, Modell-IDs und die Anfrageform. Sie können den Endpunkt auch simulieren, während Sie auf die Budgetfreigabe warten, und dann auf Live-Traffic umschalten, ohne Tests neu schreiben zu müssen. Laden Sie Apidog kostenlos herunter, um den Vergleich durchzuführen.

Das größere Bild: Der Preiskampf ist entbrannt

Dies ist die dritte größere Preisänderung am günstigen Ende der Frontier in diesem Sommer. Google hat sein Flash-Tier im Juli aktualisiert, Anthropic hat Claude Opus 5 zum halben Preis von Fable 5 eingeführt, und jetzt hat OpenAI Luna unter beide Gemini Flash-Optionen gesenkt. Die Modellqualität trennt immer noch die Flaggschiffe, aber die Arbeitstier-Stufe konvergiert auf eine einfache Regel: Wer diesen Monat am günstigsten ist, gewinnt die Batch-Jobs.

Für API-Teams bedeutet das, dass die Modellwahl keine jährliche Entscheidung mehr ist. Bauen Sie Ihre Integration so auf, dass die Modell-ID ein Konfigurationswert ist, pflegen Sie eine ständige Evaluierungssuite und führen Sie den Kostenvergleich immer dann erneut durch, wenn ein Anbieter eine Änderung vornimmt. Die Teams, die das Modell-Routing als Infrastruktur mit Tests und Überwachung behandeln, erfassen jede Preissenkung innerhalb von Tagen statt Quartalen.

FAQ

Was sind die neuen GPT-5.6 API-Preise?

Ab dem 30. Juli 2026: Luna kostet 0,20 $ pro Million Eingabe-Tokens und 1,20 $ pro Million Ausgabe; Terra kostet 2 $ und 12 $; Sol bleibt unverändert bei 5 $ und 30 $. Sol erhielt auch einen Fast-Modus zum doppelten Standardpreis für eine 2,5x schnellere Verarbeitung.

Wurde der Preis für GPT-5.6 Sol gesenkt?

Nein. Die Standardpreise von Sol sind unverändert. Die Änderungen an Sol sind struktureller Natur: Ein neuer Fast-Modus ersetzt die Priority-Processing-Stufe und tauscht den doppelten Preis gegen die 2,5-fache Geschwindigkeit ein.

Ist GPT-5.6 Luna jetzt günstiger als Gemini Flash?

Laut Listenpreis, ja. Lunas kombinierter Input-plus-Output-Preis beträgt 1,40 $ pro Million Tokens gegenüber 2,80 $ für Gemini 3.5 Flash-Lite und 9 $ für Gemini 3.6 Flash. Preis ist jedoch nicht gleich Qualität: Führen Sie beide gegen Ihr eigenes Evaluierungs-Set aus, bevor Sie wechseln. Wenn Sie zuerst den kostenlosen Weg wählen möchten, sehen Sie wie Sie GPT-5.6 kostenlos nutzen können.

Gelten die Preissenkungen automatisch?

Ja. Die neuen Tarife gelten ab dem 30. Juli 2026 für die Standard-API-Nutzung, ohne dass Code-Änderungen erforderlich sind. Sie müssen nur handeln, wenn Sie Priority Processing auf Sol verwenden, das durch den Fast-Modus ersetzt wird.

Was diese Woche zu tun ist

Die neue Preisliste belohnt Teams, die schnell handeln. Führen Sie Ihr Kostenmodell mit den neuen Zahlen erneut aus, bewerten Sie neu, welche Workloads Luna zu 96 % unter Sols Preis absorbieren kann, und prüfen Sie, ob Terras 20%ige Kürzung irgendwelche Routing-Schwellenwerte ändert. Verifizieren Sie dann mit realem Traffic anstatt mit Listenpreis-Mathematik: Ein Testszenario in Apidog, drei Modell-IDs und die usage-Zahlen werden Ihnen genau sagen, was die Kürzung für Sie wert ist.

App herunterladen

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen