El modelo insignia de OpenAI está en oferta. Desde el 17 de agosto hasta el 18 de septiembre de 2026, Vercel está ofreciendo un descuento del 50% en GPT-5.6 Sol para cada solicitud que pase por su AI Gateway. El precio de entrada baja de $5.00 a $2.50 por millón de tokens. El precio de salida baja de $30.00 a $15.00. Sin código promocional, sin cambio de plan, sin cambio de código: si tus solicitudes ya se enrutan a través del Gateway, el descuento se aplica automáticamente.
Esto es importante porque Sol fue el único nivel que OpenAI no tocó en su recorte de precios del 30 de julio. Luna se abarató un 80% y Terra un 20%, pero Sol se mantuvo en $5/$30. Durante un mes, el modelo insignia cuesta casi lo mismo que Terra a precio de lista.
Si quieres aprovechar esta oportunidad, esta publicación cubre los números exactos, la letra pequeña que decide si calificas y cómo apuntar tu cliente OpenAI existente (o un cliente API como Apidog) al punto final del Gateway en unos dos minutos.
Los números exactos
Vercel aplica descuentos a los tres niveles de servicio Sol, no solo al predeterminado:
| Nivel de servicio | Precio normal (por MTok, entrada/salida) | Precio promocional (por MTok, entrada/salida) |
|---|---|---|
| Predeterminado | $5.00 / $30.00 | $2.50 / $15.00 |
| Flex | $2.50 / $15.00 | $1.25 / $7.50 |
| Prioridad (modo rápido) | $10.00 / $60.00 | $5.00 / $30.00 |
El descuento estará vigente desde el 17 de agosto hasta el 18 de septiembre de 2026 y cubre tokens en caché, escrituras en caché, solicitudes de contexto largo y todas las regiones.
Dos detalles a destacar en la tabla:
- Flex a $1.25/$7.50 es la noticia más discreta. Si tu carga de trabajo tolera una finalización más lenta (análisis por lotes, evaluaciones sin conexión, generación de documentos), estás obteniendo una salida de calidad insignia a menos de la mitad del precio de lista de Terra.
- Prioridad a la tarifa promocional ($5/$30) cuesta exactamente lo mismo que Sol predeterminado normalmente. Durante un mes, el "modo rápido de Sol" es gratuito en el sentido de que pagas el precio estándar de ayer por él.
Como referencia, los precios de la API de OpenAI todavía listan Sol a $5/$30, y eso es lo que pagas si vas directo o usas tu propia clave. Mantenemos un desglose completo de la estructura de niveles actual en nuestra guía de precios de GPT-5.6.
Qué es Vercel AI Gateway (versión de 30 segundos)
AI Gateway es la API de modelo unificado de Vercel. Una clave de API te da acceso a cientos de modelos de OpenAI, Anthropic, Google y otros, con conmutación por error automática entre proveedores, monitoreo de gastos y, según Vercel, margen de beneficio cero en los tokens: normalmente pagas exactamente lo que cobra el proveedor.
Ese último punto es lo que hace inusual esta promoción. El Gateway no está descontando su tarifa (no hay una sobre los tokens). Está vendiendo tokens Sol por debajo del precio de lista de OpenAI. Durante este período, el Gateway es la forma legítima más barata de llamar a Sol.
El Gateway habla tres dialectos:
- El AI SDK de forma nativa (el kit de herramientas TypeScript de Vercel, cubierto en nuestra guía de Vercel AI SDK)
- OpenAI Chat Completions and Responses, en una URL base compatible con OpenAI
- Anthropic Messages, para clientes construidos contra Claude
La superficie compatible con OpenAI es la que la mayoría de los equipos utilizará, porque significa que tu cliente OpenAI existente funciona con un cambio de una sola línea.
Cómo usarlo
Con el AI SDK
import { streamText } from 'ai';
const result = streamText({
model: 'openai/gpt-5.6-sol',
prompt: 'Investigate the failing tests and open a PR with a fix.',
});
Con cualquier cliente OpenAI
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("AI_GATEWAY_API_KEY"),
base_url="https://ai-gateway.vercel.sh/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Summarize this OpenAPI diff."}],
)
Con curl
curl -X POST "https://ai-gateway.vercel.sh/v1/chat/completions" \
-H "Authorization: Bearer $AI_GATEWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-sol",
"messages": [{"role": "user", "content": "Hello, Sol."}]
}'
Observa el formato del ID del modelo: openai/gpt-5.6-sol, con el prefijo del proveedor. Un simple gpt-5.6-sol devuelve un 404 de la ruta /models. Si eres nuevo en la familia de modelos, comienza con nuestra guía de la API de GPT-5.6.
Probando el endpoint antes de asignar tráfico
Antes de cambiar el tráfico de producción a una nueva URL base, vale la pena verificar que el Gateway se comporta de manera idéntica al endpoint de OpenAI que estás dejando: misma forma de respuesta, mismo comportamiento de llamada a herramientas, mismos fragmentos de transmisión. Esto es un trabajo de cinco minutos en Apidog: crea una variable de entorno para la URL base, añade tu clave de Gateway como un secreto en el almacén y ejecuta tu colección de solicitudes OpenAI existente contra https://ai-gateway.vercel.sh/v1. Dado que el Gateway implementa la especificación de Chat Completions, tus aserciones sobre la estructura de respuesta deberían pasar sin cambios, y si no lo hacen, habrás encontrado la incompatibilidad antes que tus usuarios.
La misma configuración hace que la comparación de costos sea concreta: envía un prompt a openai/gpt-5.6-sol, openai/gpt-5.6-terra y openai/gpt-5.6-luna uno al lado del otro, compara las salidas y verifica los recuentos de tokens en el bloque de uso. Descarga Apidog gratis si quieres ejecutar ese experimento; requiere una colección y tres cambios de entorno.
La letra pequeña que decide si ahorras algo
El registro de cambios es corto, pero tres condiciones importan:
- Solo solicitudes directas al Gateway, no BYOK. Si has configurado "Bring Your Own Key" (Trae Tu Propia Clave) para que el Gateway reenvíe solicitudes en tu cuenta de OpenAI, se te facturará según las tarifas de OpenAI y la promoción no se aplicará. Para obtener el descuento, tus solicitudes deben ejecutarse con las claves de Vercel, lo que significa que el Gateway gestiona la facturación.
- Termina el 18 de septiembre. Las previsiones de presupuesto basadas en $2.50/$15 serán erróneas por 2x en octubre. Si estás realizando un trabajo puntual (una gran carga de datos, un barrido de evaluación, un reetiquetado de conjunto de datos), el período es un regalo. Si estás estableciendo una base económica unitaria permanente, utiliza el precio de lista.
- El precio de lista de Sol no cambió. OpenAI no ha bajado el precio de Sol. Si interpretas esto como una señal de hacia dónde se dirigen los precios de Sol, eso es especulación; el único número comprometido es el de Vercel, y solo hasta el 18 de septiembre.
Cuándo vale la pena pagar los precios de Sol
El descuento solo importa si Sol es el nivel adecuado para el trabajo. La ventaja de Sol sobre Terra y Luna se manifiesta en el extremo difícil de la distribución: tareas de agente de largo horizonte, orquestación compleja de herramientas y, según pruebas recientes de terceros, visión.
Los benchmarks de Roboflow publicados esta semana encontraron que Sol alcanzó 46.2 mAP@50 en detección de objetos, frente a 13.8 para GPT-5.5, y 73% en conteo de objetos. A precios normales, esa capacidad cuesta alrededor de 2.5 centavos por imagen. Durante el período promocional, está más cerca de 1.2 centavos, lo que convierte "ejecutar Sol sobre todo nuestro archivo de documentos" de una solicitud de presupuesto a un experimento de una tarde. Nuestro resumen de benchmarks de Sol tiene los números más amplios si estás decidiendo entre niveles.
El contrapunto honesto de los mismos datos de Roboflow: Gemini 3.5 Flash sigue superando a Sol en detección, costando 0.8 centavos por imagen. Un descuento reduce la brecha; no la borra. Ejecuta tu propia evaluación con tus propios datos antes de comprometerte de una forma u otra.
La estrategia para equipos de API
Si construyes o pruebas APIs para ganarte la vida, aquí tienes la lista de verificación práctica para el próximo mes:
- Anticipa el trabajo intensivo de Sol. Barridos de evaluación, generación de datos de prueba sintéticos, revisiones de especificaciones, borradores de documentos: cualquier cosa que eventualmente ejecutarías con Sol, hazlo antes del 18 de septiembre a mitad de precio.
- Realiza pruebas A/B entre los niveles mientras el modelo insignia es barato. El argumento habitual contra la comparación de Sol con Terra en tu carga de trabajo es que la comparación en sí cuesta dinero. Ahora mismo, Sol tiene un precio cercano a Terra, por lo que el experimento es casi gratuito. Conserva los resultados; seguirán siendo válidos después de que termine la promoción.
- Vigila tu panel de uso. El monitoreo de gastos del Gateway muestra el costo por modelo, por lo que verás la tarifa con descuento reflejada allí. Si tus números aún muestran $5/$30, verifica si BYOK te está enrutando silenciosamente a tu propia cuenta de OpenAI.
Preguntas frecuentes
¿Necesito cambiar mi código para obtener el descuento? No. Si tus solicitudes ya se ejecutan a través de AI Gateway con la facturación de Vercel, el descuento se aplica automáticamente a partir del 17 de agosto. Los nuevos usuarios necesitan una cuenta de Vercel y una clave de API de Gateway, luego apuntar cualquier cliente compatible con OpenAI a https://ai-gateway.vercel.sh/v1.
¿El descuento se aplica a los tokens en caché y a las solicitudes de contexto largo? Sí. El registro de cambios de Vercel indica que el 50% de descuento cubre tokens en caché, escrituras en caché, solicitudes de contexto largo y todas las regiones.
¿Se aplica si uso mi propia clave de OpenAI (BYOK)? No. Las solicitudes BYOK se facturan a las tarifas del proveedor de OpenAI ($5/$30 para Sol predeterminado) y están excluidas de la promoción.
¿Esto es lo mismo que si OpenAI redujera el precio de Sol? No. El precio de lista de OpenAI para Sol no ha cambiado. Esto es Vercel descontando el tráfico del Gateway durante un mes. El último cambio que hizo OpenAI fue el recorte del 30 de julio para Luna y Terra, que omitió Sol.
¿Cómo verifico que estoy obteniendo Sol y no un modelo de respaldo? El Gateway admite el enrutamiento y los respaldos del proveedor, así que fija explícitamente el modelo como openai/gpt-5.6-sol y verifica el campo model en el cuerpo de la respuesta. En Apidog puedes añadir una aserción sobre ese campo a cada solicitud en tu colección, de modo que un respaldo silencioso falle la prueba en lugar de facturarte discretamente por un nivel diferente. Si todavía estás eligiendo un nivel, nuestro explicador qué es GPT-5.6 Sol cubre dónde el modelo insignia se gana su precio.
Vale la pena aprovechar, con un recordatorio en el calendario
Un descuento del 50% en un modelo insignia sin margen de beneficio es raro, y las condiciones son claras: enruta a través del Gateway, no uses BYOK, hazlo antes del 18 de septiembre. Adelanta el trabajo costoso, realiza la comparación de niveles que has estado posponiendo y configura un recordatorio para cuando los cálculos vuelvan a la normalidad.
Y antes de que se mueva ese tráfico, prueba el endpoint como probarías cualquier otra dependencia de API. Apidog te proporciona el cambio de entorno, el almacenamiento seguro de secretos y las aserciones de respuesta para intercambiar URLs base sin conjeturas. Pruébalo gratis y apunta tu primera colección al Gateway.
botón
