Le modèle phare d'OpenAI est en promotion. Du 17 août au 18 septembre 2026, Vercel offre une réduction de 50 % sur GPT-5.6 Sol pour chaque requête passant par son AI Gateway. Le coût d'entrée passe de 5,00 $ à 2,50 $ par million de jetons. Le coût de sortie passe de 30,00 $ à 15,00 $. Pas de code promo, pas de changement de plan, pas de modification de code : si vos requêtes passent déjà par le Gateway, la réduction est appliquée automatiquement.
Ceci est important car Sol était la seule catégorie qu'OpenAI n'avait pas touchée lors de sa réduction de prix du 30 juillet. Luna est devenue 80 % moins chère et Terra 20 % moins chère, mais Sol est restée à 5 $/30 $. Pendant un mois, le modèle phare coûte presque le même prix que Terra à son prix catalogue.
Si vous souhaitez profiter de cette opportunité, cet article couvre les chiffres exacts, les petites lignes qui déterminent votre éligibilité, et comment faire pointer votre client OpenAI existant (ou un client API comme Apidog) vers l'endpoint du Gateway en deux minutes environ.
Les chiffres exacts
Vercel réduit les prix des trois niveaux de service Sol, pas seulement celui par défaut :
| Niveau de service | Prix normal (par MTok, entrée/sortie) | Prix promo (par MTok, entrée/sortie) |
|---|---|---|
| Par défaut | $5.00 / $30.00 | $2.50 / $15.00 |
| Flex | $2.50 / $15.00 | $1.25 / $7.50 |
| Priorité (mode rapide) | $10.00 / $60.00 | $5.00 / $30.00 |
La réduction est valable du 17 août au 18 septembre 2026 et couvre les jetons mis en cache, les écritures de cache, les requêtes à long contexte et toutes les régions.
Deux détails à noter dans le tableau :
- Le Flex à 1,25 $/7,50 $ est la bonne nouvelle discrète. Si votre charge de travail tolère une complétion plus lente (analyse par lots, évaluations hors ligne, génération de documents), vous obtenez une sortie de qualité phare à moins de la moitié du prix catalogue de Terra.
- Le mode Priorité au tarif promo (5 $/30 $) coûte exactement ce que coûte normalement le Sol par défaut. Pendant un mois, le « mode rapide Sol » est gratuit dans le sens où vous payez le prix standard d'hier pour l'obtenir.
À titre de référence, la tarification API d'OpenAI liste toujours Sol à 5 $/30 $, et c'est ce que vous payez en allant directement ou en utilisant votre propre clé. Nous maintenons une analyse complète de la structure des niveaux actuels dans notre guide de tarification GPT-5.6.
Qu'est-ce que Vercel AI Gateway (version 30 secondes)
AI Gateway est l'API de modèle unifiée de Vercel. Une seule clé API vous donne accès à des centaines de modèles d'OpenAI, Anthropic, Google et d'autres, avec basculement automatique entre les fournisseurs, surveillance des dépenses, et, selon Vercel, aucune majoration sur les jetons : vous payez normalement exactement ce que le fournisseur facture.
Ce dernier point rend cette promotion inhabituelle. Le Gateway ne réduit pas ses frais (il n'y en a pas sur les jetons). Il vend les jetons Sol en dessous du prix catalogue d'OpenAI. Pendant cette période, le Gateway est le moyen légitime le moins cher d'appeler Sol.
Le Gateway parle trois dialectes :
- Le AI SDK nativement (la boîte à outils TypeScript de Vercel, couverte dans notre guide Vercel AI SDK)
- Completions et Réponses de Chat OpenAI, à une URL de base compatible OpenAI
- Messages Anthropic, pour les clients développés pour Claude
L'interface compatible OpenAI est celle que la plupart des équipes utiliseront, car cela signifie que votre client OpenAI existant fonctionne avec une modification d'une seule ligne.
Comment l'utiliser
Avec le AI SDK
import { streamText } from 'ai';
const result = streamText({
model: 'openai/gpt-5.6-sol',
prompt: 'Investigate the failing tests and open a PR with a fix.',
});
Avec n'importe quel client OpenAI
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("AI_GATEWAY_API_KEY"),
base_url="https://ai-gateway.vercel.sh/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Summarize this OpenAPI diff."}],
)
Avec curl
curl -X POST "https://ai-gateway.vercel.sh/v1/chat/completions" \
-H "Authorization: Bearer $AI_GATEWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-sol",
"messages": [{"role": "user", "content": "Hello, Sol."}]
}'
Notez le format de l'ID du modèle : openai/gpt-5.6-sol, avec le préfixe du fournisseur. Un simple gpt-5.6-sol renvoie une erreur 404 depuis la route /models. Si vous débutez avec la famille de modèles elle-même, commencez par notre guide de l'API GPT-5.6.
Tester l'endpoint avant d'engager le trafic
Avant de basculer le trafic de production vers une nouvelle URL de base, il est utile de vérifier que le Gateway se comporte de manière identique à l'endpoint OpenAI que vous quittez : même forme de réponse, même comportement d'appel d'outils, mêmes blocs de streaming. C'est un travail de cinq minutes dans Apidog : créez une variable d'environnement pour l'URL de base, ajoutez votre clé Gateway comme secret de coffre-fort, et exécutez votre collection de requêtes OpenAI existante contre https://ai-gateway.vercel.sh/v1. Parce que le Gateway implémente la spécification Chat Completions, vos assertions sur la structure de la réponse devraient passer sans changement, et si ce n'est pas le cas, vous avez trouvé l'incompatibilité avant vos utilisateurs.
La même configuration rend la comparaison des coûts concrète : envoyez un prompt à openai/gpt-5.6-sol, openai/gpt-5.6-terra, et openai/gpt-5.6-luna côte à côte, comparez les sorties, et vérifiez le nombre de jetons dans le bloc d'utilisation. Téléchargez Apidog gratuitement si vous voulez exécuter cette expérience ; cela prend une collection et trois changements d'environnement.
Les petites lignes qui décident si vous économisez quoi que ce soit
Le journal des modifications est court, mais trois conditions sont importantes :
- Requêtes directes via le Gateway uniquement, pas de BYOK. Si vous avez configuré "Apportez Votre Propre Clé" (BYOK) de sorte que le Gateway transmette les requêtes sur votre compte OpenAI, vous êtes facturé aux tarifs d'OpenAI et la promotion ne s'applique pas. Pour bénéficier de la réduction, vos requêtes doivent s'exécuter sur les clés de Vercel, ce qui signifie que le Gateway gère la facturation.
- Elle se termine le 18 septembre. Les prévisions budgétaires basées sur 2,50 $/15 $ seront fausses d'un facteur 2 en octobre. Si vous effectuez une opération ponctuelle (un grand remplissage, une série d'évaluations, une réétiquetage de dataset), cette période est un cadeau. Si vous établissez une base économique unitaire permanente, utilisez le prix catalogue.
- Le prix catalogue de Sol n'a pas changé. OpenAI n'a pas réduit le prix de Sol. Si vous lisez ceci comme un signal sur l'évolution des prix de Sol, il s'agit d'une spéculation ; le seul chiffre engagé est celui de Vercel, et seulement jusqu'au 18 septembre.
Quand payer les prix de Sol en vaut la peine
La réduction n'est pertinente que si Sol est le bon niveau pour le travail. L'avantage de Sol sur Terra et Luna se manifeste sur les tâches les plus exigeantes : tâches d'agent à long terme, orchestration complexe d'outils et, selon de récents tests tiers, la vision.
Les benchmarks de Roboflow publiés cette semaine ont montré que Sol atteignait 46,2 mAP@50 en détection d'objets, contre 13,8 pour GPT-5.5, et 73 % en comptage d'objets. Aux prix normaux, cette capacité coûte environ 2,5 cents par image. Pendant la période de promotion, c'est plus proche de 1,2 cents, ce qui transforme « exécuter Sol sur toute notre archive de documents » d'une demande budgétaire en une expérience d'après-midi. Notre récapitulatif des benchmarks Sol contient des chiffres plus larges si vous hésitez entre les niveaux.
Le contre-argument honnête des mêmes données Roboflow : Gemini 3.5 Flash surpasse toujours Sol en détection tout en coûtant 0,8 cents par image. Une réduction réduit l'écart ; elle ne l'efface pas. Effectuez votre propre évaluation sur vos propres données avant de vous engager dans un sens ou dans l'autre.
Le plan pour les équipes API
Si vous créez ou testez des API pour gagner votre vie, voici la liste de contrôle pratique pour le mois prochain :
- Priorisez le travail intensif en Sol. Balayages d'évaluation, génération de données de test synthétiques, passages de révision de spécifications, brouillons de documents : tout ce que vous exécuteriez finalement via Sol, exécutez-le avant le 18 septembre à moitié prix.
- Faites des tests A/B sur les niveaux tant que le modèle phare est bon marché. L'argument habituel contre la comparaison de Sol à Terra sur votre charge de travail est que la comparaison elle-même coûte de l'argent. Actuellement, Sol est tarifé près de Terra, donc l'expérience est presque gratuite. Conservez les résultats ; ils resteront valides après la fin de la promotion.
- Surveillez votre tableau de bord d'utilisation. Le suivi des dépenses du Gateway affiche le coût par modèle, vous verrez donc le taux réduit y être reflété. Si vos chiffres affichent toujours 5 $/30 $, vérifiez si le BYOK ne vous redirige pas silencieusement vers votre propre compte OpenAI.
FAQ
- Dois-je modifier mon code pour bénéficier de la réduction ? Non. Si vos requêtes passent déjà par l'AI Gateway avec la facturation de Vercel, la réduction est appliquée automatiquement à partir du 17 août. Les nouveaux utilisateurs ont besoin d'un compte Vercel et d'une clé API Gateway, puis de pointer n'importe quel client compatible OpenAI vers
https://ai-gateway.vercel.sh/v1. - La réduction s'applique-t-elle aux jetons mis en cache et aux requêtes à long contexte ? Oui. Le journal des modifications de Vercel indique que la réduction de 50 % couvre les jetons mis en cache, les écritures de cache, les requêtes à long contexte et toutes les régions.
- S'applique-t-elle si j'apporte ma propre clé OpenAI ? Non. Les requêtes BYOK sont facturées aux tarifs du fournisseur OpenAI (5 $/30 $ pour Sol par défaut) et sont exclues de la promotion.
- Est-ce la même chose qu'une réduction de prix de Sol par OpenAI ? Non. Le prix catalogue d'OpenAI pour Sol reste inchangé. Il s'agit d'une réduction de Vercel sur le trafic du Gateway pendant un mois. La dernière modification apportée par OpenAI lui-même était la réduction du 30 juillet pour Luna et Terra, qui a ignoré Sol.
- Comment vérifier que j'obtiens Sol et non un modèle de secours ? Le Gateway prend en charge le routage et les mécanismes de secours des fournisseurs, donc épinglez explicitement le modèle comme
openai/gpt-5.6-solet vérifiez le champmodeldans le corps de la réponse. Dans Apidog, vous pouvez ajouter une assertion sur ce champ à chaque requête de votre collection, de sorte qu'un secours silencieux échoue au test au lieu de vous facturer discrètement un niveau différent. Si vous êtes encore en train de choisir un niveau, notre explication sur ce qu'est GPT-5.6 Sol couvre où le modèle phare justifie son prix.
À saisir, avec un rappel calendrier
Une réduction de 50 % sur un modèle phare sans majoration est rare, et les conditions sont claires : passez par le Gateway, n'utilisez pas de BYOK, et faites-le avant le 18 septembre. Priorisez le travail coûteux, effectuez la comparaison de niveaux que vous avez reportée, et mettez un rappel pour le moment où les calculs reviendront à la normale.
Et avant que ce trafic ne soit déployé, testez l'endpoint comme vous testeriez toute autre dépendance API. Apidog vous offre le changement d'environnement, le stockage sécurisé des secrets et les assertions de réponse pour échanger les URL de base sans deviner. Essayez-le gratuitement et faites pointer votre première collection vers le Gateway.
