OpenAIs Flaggschiffmodell ist im Angebot. Vom 17. August bis zum 18. September 2026 bietet Vercel einen Rabatt von 50 % auf GPT-5.6 Sol für jede Anfrage, die über sein AI Gateway läuft. Die Eingabe fällt von 5,00 $ auf 2,50 $ pro Million Tokens. Die Ausgabe fällt von 30,00 $ auf 15,00 $. Kein Promocode, keine Planänderung, keine Codeänderung: Wenn Ihre Anfragen bereits über das Gateway geleitet werden, wird der Rabatt automatisch angewendet.
Dies ist wichtig, da Sol die einzige Stufe war, die OpenAI bei seiner Preissenkung am 30. Juli unberührt ließ. Luna wurde um 80 % und Terra um 20 % günstiger, aber Sol blieb bei 5 $/30 $. Für einen Monat kostet das Flaggschiff fast so viel wie Terra zum Listenpreis.
Wenn Sie das Zeitfenster nutzen möchten, behandelt dieser Beitrag die genauen Zahlen, das Kleingedruckte, das entscheidet, ob Sie sich qualifizieren, und wie Sie Ihren vorhandenen OpenAI-Client (oder einen API-Client wie Apidog) in etwa zwei Minuten auf den Gateway-Endpunkt verweisen können.
Die genauen Zahlen
Vercel rabattiert alle drei Sol-Dienststufen, nicht nur die Standardstufe:
| Dienststufe | Normalpreis (pro MTok, Input/Output) | Aktionspreis (pro MTok, Input/Output) |
|---|---|---|
| Standard | $5.00 / $30.00 | $2.50 / $15.00 |
| Flex | $2.50 / $15.00 | $1.25 / $7.50 |
| Priorität (schneller Modus) | $10.00 / $60.00 | $5.00 / $30.00 |
Der Rabatt gilt vom 17. August bis zum 18. September 2026 und umfasst gecachte Tokens, Cache-Schreibvorgänge, Anfragen mit langem Kontext und alle Regionen.
Zwei bemerkenswerte Details in der Tabelle:
- Flex für 1,25 $/7,50 $ ist die stille Schlagzeile. Wenn Ihre Arbeitslast eine langsamere Vervollständigung toleriert (Batch-Analyse, Offline-Bewertungen, Dokumentengenerierung), erhalten Sie eine Flaggschiff-Qualität der Ausgabe zu weniger als der Hälfte des Listenpreises von Terra.
- Priorität zum Aktionspreis (5 $/30 $) kostet genau das, was Standard-Sol normalerweise kostet. Für einen Monat ist „Sol im schnellen Modus“ in dem Sinne kostenlos, dass Sie den Standardpreis von gestern dafür zahlen.
Als Referenz listet OpenAI’s eigene API-Preisgestaltung Sol immer noch mit 5 $/30 $, und das ist das, was Sie zahlen, wenn Sie direkt gehen oder Ihren eigenen Schlüssel verwenden. Eine vollständige Aufschlüsselung der aktuellen Stufenstruktur finden Sie in unserem GPT-5.6-Preisleitfaden.
Was das Vercel AI Gateway ist (30-Sekunden-Version)
AI Gateway ist Vercels vereinheitlichte Modell-API. Ein API-Schlüssel ermöglicht Ihnen den Zugriff auf Hunderte von Modellen von OpenAI, Anthropic, Google und anderen, mit automatischem Failover zwischen Anbietern, Ausgabenüberwachung und, laut Vercel, null Aufschlag auf Tokens: Sie zahlen normalerweise genau das, was der Anbieter berechnet.
Dieser letzte Punkt macht diese Aktion ungewöhnlich. Das Gateway rabattiert nicht seine Gebühr (es gibt keine für Tokens). Es verkauft Sol-Tokens unter dem OpenAI-Listenpreis. Während des Aktionszeitraums ist das Gateway der günstigste legitime Weg, Sol aufzurufen.
Das Gateway spricht drei Dialekte:
- Nativ das AI SDK (Vercels TypeScript-Toolkit, behandelt in unserem Vercel AI SDK-Leitfaden)
- OpenAI Chat Completions und Responses, unter einer OpenAI-kompatiblen Basis-URL
- Anthropic Messages, für Clients, die für Claude entwickelt wurden
Die OpenAI-kompatible Oberfläche ist die, die die meisten Teams verwenden werden, da Ihr vorhandener OpenAI-Client mit einer einzeiligen Änderung funktioniert.
So verwenden Sie es
Mit dem AI SDK
import { streamText } from 'ai';
const result = streamText({
model: 'openai/gpt-5.6-sol',
prompt: 'Investigate the failing tests and open a PR with a fix.',
});
Mit jedem OpenAI-Client
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("AI_GATEWAY_API_KEY"),
base_url="https://ai-gateway.vercel.sh/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Summarize this OpenAPI diff."}],
)
Mit curl
curl -X POST "https://ai-gateway.vercel.sh/v1/chat/completions" \
-H "Authorization: Bearer $AI_GATEWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-sol",
"messages": [{"role": "user", "content": "Hello, Sol."}]
}'
Beachten Sie das Format der Modell-ID: openai/gpt-5.6-sol, mit dem Anbieterpräfix. Ein einfaches gpt-5.6-sol gibt einen 404-Fehler von der /models-Route zurück. Wenn Sie neu in der Modellfamilie sind, beginnen Sie mit unserem GPT-5.6 API-Leitfaden.
Endpunkt testen, bevor Sie Traffic freigeben
Bevor Sie den Produktions-Traffic auf eine neue Basis-URL umstellen, lohnt es sich zu überprüfen, ob das Gateway sich identisch mit dem OpenAI-Endpunkt verhält, den Sie verlassen: gleiche Antwortstruktur, gleiches Tool-Calling-Verhalten, gleiche Streaming-Chunks. Dies ist eine Fünf-Minuten-Aufgabe in Apidog: Erstellen Sie eine Umgebungsvariable für die Basis-URL, fügen Sie Ihren Gateway-Schlüssel als Vault-Geheimnis hinzu und führen Sie Ihre vorhandene OpenAI-Anforderungssammlung gegen https://ai-gateway.vercel.sh/v1 aus. Da das Gateway die Chat Completions-Spezifikation implementiert, sollten Ihre Annahmen zur Antwortstruktur unverändert bestehen bleiben, und wenn nicht, haben Sie die Inkompatibilität gefunden, bevor Ihre Benutzer es getan haben.
Dieselbe Einrichtung macht den Kostenvergleich konkret: Senden Sie eine Aufforderung an openai/gpt-5.6-sol, openai/gpt-5.6-terra und openai/gpt-5.6-luna nebeneinander, vergleichen Sie die Ausgaben und überprüfen Sie die Token-Zahlen im Nutzungsblock. Laden Sie Apidog kostenlos herunter, wenn Sie dieses Experiment durchführen möchten; es erfordert eine Sammlung und drei Umgebungsumschaltungen.
Das Kleingedruckte, das entscheidet, ob Sie etwas sparen
Das Änderungsprotokoll ist kurz, aber drei Bedingungen sind wichtig:
- Nur direkte Gateway-Anfragen, nicht BYOK. Wenn Sie „Bring Your Own Key“ konfiguriert haben, sodass das Gateway Anfragen über Ihr OpenAI-Konto weiterleitet, werden Ihnen die OpenAI-Tarife berechnet und die Aktion gilt nicht. Um den Rabatt zu erhalten, müssen Ihre Anfragen über Vercels Schlüssel laufen, was bedeutet, dass das Gateway die Abrechnung übernimmt.
- Es endet am 18. September. Budgetprognosen, die auf 2,50 $/15 $ basieren, werden im Oktober um das Doppelte falsch sein. Wenn Sie eine einmalige Aktion durchführen (ein großes Backfill, eine Evaluierung, eine Dataset-Neubeschriftung), ist das Zeitfenster ein Geschenk. Wenn Sie eine dauerhafte Grundlage für die Einheitspreise festlegen, verwenden Sie den Listenpreis.
- Sols Listenpreis hat sich nicht geändert. OpenAI hat Sol nicht gesenkt. Wenn Sie dies als Signal dafür lesen, wohin die Sol-Preise gehen, ist das Spekulation; die einzige verbindliche Zahl ist die von Vercel, und nur bis zum 18. September.
Wann sich Sol-Preise überhaupt lohnen
Der Rabatt ist nur relevant, wenn Sol die richtige Stufe für die Aufgabe ist. Sols Vorsprung gegenüber Terra und Luna zeigt sich am oberen Ende der Verteilung: bei Agentenaufgaben mit langem Horizont, komplexer Werkzeugorchestration und, laut jüngsten Drittanbieter-Tests, bei der Bilderkennung.
Roboflows Benchmarks, diese Woche veröffentlicht, ergaben, dass Sol bei der Objekterkennung einen mAP@50 von 46,2 erreichte, gegenüber 13,8 für GPT-5.5, und 73 % beim Objektzählen. Zu normalen Preisen kostet diese Funktion etwa 2,5 Cent pro Bild. Während des Aktionszeitraums sind es näher an 1,2 Cent, was „Sol über unser gesamtes Dokumentenarchiv laufen lassen“ von einer Budgetanfrage zu einem Nachmittagsexperiment macht. Unser Sol-Benchmarks-Rückblick enthält die umfassenderen Zahlen, wenn Sie zwischen den Stufen wählen.
Der ehrliche Gegenpunkt aus denselben Roboflow-Daten: Gemini 3.5 Flash schlägt Sol immer noch bei der Erkennung, während es 0,8 Cent pro Bild kostet. Ein Rabatt verringert den Abstand; er eliminiert ihn nicht. Führen Sie Ihre eigene Bewertung mit Ihren eigenen Daten durch, bevor Sie sich festlegen.
Das Spiel für API-Teams
Wenn Sie beruflich APIs entwickeln oder testen, finden Sie hier die praktische Checkliste für den nächsten Monat:
- Sol-intensive Arbeiten vorziehen. Evaluierungsläufe, Generierung synthetischer Testdaten, Spezifikationsüberprüfungen, Dokumentenentwürfe: alles, was Sie irgendwann durch Sol laufen lassen würden, führen Sie vor dem 18. September zum halben Preis aus.
- Führen Sie A/B-Tests der Stufen durch, solange das Flaggschiff günstig ist. Das übliche Argument gegen den Vergleich von Sol mit Terra bei Ihrer Arbeitslast ist, dass der Vergleich selbst Geld kostet. Im Moment ist Sol preislich nahe an Terra angesiedelt, so dass das Experiment nahezu kostenlos ist. Behalten Sie die Ergebnisse; sie bleiben nach Ablauf der Aktion gültig.
- Behalten Sie Ihr Nutzungs-Dashboard im Auge. Die Ausgabenüberwachung des Gateways zeigt die Kosten pro Modell an, sodass Sie dort den rabattierten Preis sehen. Wenn Ihre Zahlen immer noch 5 $/30 $ anzeigen, prüfen Sie, ob BYOK Sie stillschweigend zu Ihrem eigenen OpenAI-Konto leitet.
FAQ
Muss ich meinen Code ändern, um den Rabatt zu erhalten? Nein. Wenn Ihre Anfragen bereits über das AI Gateway auf Vercels Abrechnung laufen, wird der Rabatt ab dem 17. August automatisch angewendet. Neue Benutzer benötigen ein Vercel-Konto und einen Gateway-API-Schlüssel und müssen dann einen beliebigen OpenAI-kompatiblen Client auf https://ai-gateway.vercel.sh/v1 verweisen.
Gilt der Rabatt auch für gecachte Tokens und Anfragen mit langem Kontext? Ja. Das Änderungsprotokoll von Vercel besagt, dass der 50%-Rabatt gecachte Tokens, Cache-Schreibvorgänge, Anfragen mit langem Kontext und alle Regionen abdeckt.
Gilt es, wenn ich meinen eigenen OpenAI-Schlüssel mitbringe? Nein. BYOK-Anfragen werden zu den Anbietertarifen von OpenAI ($5/$30 für Standard-Sol) abgerechnet und sind von der Aktion ausgeschlossen.
Ist das dasselbe wie eine Preissenkung von Sol durch OpenAI? Nein. OpenAIs Listenpreis für Sol ist unverändert. Dies ist ein Rabatt von Vercel auf den Gateway-Traffic für einen Monat. Die letzte Änderung, die OpenAI selbst vorgenommen hat, war die Preissenkung für Luna und Terra am 30. Juli, die Sol ausließ.
Wie überprüfe ich, ob ich Sol und nicht ein Fallback-Modell erhalte? Das Gateway unterstützt Anbieter-Routing und Fallbacks, pinnen Sie das Modell also explizit als openai/gpt-5.6-sol und überprüfen Sie das model-Feld im Antworttext. In Apidog können Sie eine Assertion für dieses Feld zu jeder Anfrage in Ihrer Sammlung hinzufügen, sodass ein stilles Fallback den Test fehlschlagen lässt, anstatt Ihnen stillschweigend eine andere Stufe in Rechnung zu stellen. Wenn Sie noch eine Stufe wählen, erklärt unser Was ist GPT-5.6 Sol-Erklärer, wo das Flaggschiff seinen Preis verdient.
Es lohnt sich, mit einer Kalendererinnerung
Ein Rabatt von 50 % auf ein Flaggschiffmodell ohne Aufschlag darunter ist selten, und die Bedingungen sind klar: Leiten Sie über das Gateway, verwenden Sie kein BYOK, erledigen Sie es bis zum 18. September. Erledigen Sie die teure Arbeit vorzeitig, führen Sie den Stufenvergleich durch, den Sie aufgeschoben haben, und stellen Sie die Erinnerung ein, wann sich die Rechnung umkehrt.
Und bevor dieser Traffic verschoben wird, testen Sie den Endpunkt, wie Sie jede andere API-Abhängigkeit testen würden. Apidog bietet Ihnen den Umgebungswechsel, die geheime Speicherung und die Antwortprüfungen, um Basis-URLs ohne Rätselraten auszutauschen. Probieren Sie es kostenlos aus und verweisen Sie Ihre erste Sammlung auf das Gateway.
