O modelo carro-chefe da OpenAI está em promoção. De 17 de agosto a 18 de setembro de 2026, a Vercel está oferecendo um desconto de 50% no GPT-5.6 Sol para cada solicitação que passa pelo seu AI Gateway. A entrada cai de US$ 5,00 para US$ 2,50 por milhão de tokens. A saída cai de US$ 30,00 para US$ 15,00. Sem código promocional, sem mudança de plano, sem mudança de código: se suas solicitações já são roteadas pelo Gateway, o desconto é aplicado automaticamente.
Isso é importante porque o Sol foi a única camada que a OpenAI deixou intocada em seu corte de preços de 30 de julho. O Luna ficou 80% mais barato e o Terra ficou 20% mais barato, mas o Sol permaneceu em US$ 5/US$ 30. Por um mês, o carro-chefe custa perto do que o Terra custa a preço de tabela.
Se você quiser aproveitar a janela, esta postagem cobre os números exatos, as letras miúdas que decidem se você se qualifica e como apontar seu cliente OpenAI existente (ou um cliente de API como o Apidog) para o endpoint do Gateway em cerca de dois minutos.
Os números exatos
A Vercel desconta todas as três camadas de serviço Sol, não apenas a padrão:
| Camada de serviço | Preço normal (por MTok, entrada/saída) | Preço promocional (por MTok, entrada/saída) |
|---|---|---|
| Padrão | $5.00 / $30.00 | $2.50 / $15.00 |
| Flex | $2.50 / $15.00 | $1.25 / $7.50 |
| Prioridade (modo rápido) | $10.00 / $60.00 | $5.00 / $30.00 |
O desconto vai de 17 de agosto a 18 de setembro de 2026 e cobre tokens em cache, gravações em cache, solicitações de contexto longo e todas as regiões.
Dois detalhes que valem a pena notar na tabela:
- Flex a US$ 1,25/US$ 7,50 é o destaque silencioso. Se sua carga de trabalho tolera conclusão mais lenta (análise em lote, avaliações offline, geração de documentos), você está obtendo uma saída com qualidade de carro-chefe por menos da metade do preço de tabela do Terra.
- Prioridade na taxa promocional (US$ 5/US$ 30) custa exatamente o que o Sol padrão custa normalmente. Por um mês, o "Sol em modo rápido" é gratuito no sentido de que você paga o preço padrão de ontem por ele.
Para referência, o preço da API da própria OpenAI ainda lista o Sol a US$ 5/US$ 30, e é isso que você paga indo direto ou usando sua própria chave. Mantemos um detalhamento completo da estrutura de camadas atual em nosso guia de preços do GPT-5.6.
O que é o Vercel AI Gateway (versão de 30 segundos)
O AI Gateway é a API de modelo unificada da Vercel. Uma chave de API dá acesso a centenas de modelos da OpenAI, Anthropic, Google e outros, com failover automático entre provedores, monitoramento de gastos e, segundo a Vercel, zero markup nos tokens: você normalmente paga exatamente o que o provedor cobra.
Esse último ponto é o que torna esta promoção incomum. O Gateway não está descontando sua taxa (não há uma para tokens). Ele está vendendo tokens Sol abaixo do preço de tabela da própria OpenAI. Durante a janela, o Gateway é a maneira legítima mais barata de chamar o Sol.
O Gateway fala três dialetos:
- O AI SDK nativamente (kit de ferramentas TypeScript da Vercel, coberto em nosso guia Vercel AI SDK)
- Conclusões e Respostas de Chat da OpenAI, em uma URL base compatível com OpenAI
- Mensagens Anthropic, para clientes construídos para o Claude
A superfície compatível com OpenAI é a que a maioria das equipes usará, porque significa que seu cliente OpenAI existente funciona com uma alteração de uma linha.
Como usar
Com o AI SDK
Se você estiver usando o AI SDK da Vercel, a string do modelo é tudo o que você precisa:
import { streamText } from 'ai';
const result = streamText({
model: 'openai/gpt-5.6-sol',
prompt: 'Investigate the failing tests and open a PR with a fix.',
});
Com qualquer cliente OpenAI
Aponte o cliente para a URL base do Gateway e troque a chave:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("AI_GATEWAY_API_KEY"),
base_url="https://ai-gateway.vercel.sh/v1",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Summarize this OpenAPI diff."}],
)
Com curl
curl -X POST "https://ai-gateway.vercel.sh/v1/chat/completions" \
-H "Authorization: Bearer $AI_GATEWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-sol",
"messages": [{"role": "user", "content": "Hello, Sol."}]
}'
Observe o formato do ID do modelo: openai/gpt-5.6-sol, com o prefixo do provedor. Um simples gpt-5.6-sol retorna um 404 da rota /models. Se você é novo na própria família de modelos, comece com nosso guia da API GPT-5.6.
Testando o endpoint antes de direcionar o tráfego
Antes de direcionar o tráfego de produção para uma nova URL base, vale a pena verificar se o Gateway se comporta de forma idêntica ao endpoint OpenAI que você está deixando: mesma forma de resposta, mesmo comportamento de chamada de ferramenta, mesmos chunks de streaming. Este é um trabalho de cinco minutos no Apidog: crie uma variável de ambiente para a URL base, adicione sua chave de Gateway como um segredo do cofre e execute sua coleção de solicitações OpenAI existente contra https://ai-gateway.vercel.sh/v1. Como o Gateway implementa a especificação de Conclusões de Chat, suas asserções sobre a estrutura da resposta devem passar inalteradas, e se não passarem, você encontrou a incompatibilidade antes que seus usuários o fizessem.
A mesma configuração torna a comparação de custos concreta: envie um prompt para openai/gpt-5.6-sol, openai/gpt-5.6-terra e openai/gpt-5.6-luna lado a lado, compare as saídas e verifique as contagens de tokens no bloco de uso. Baixe o Apidog gratuitamente se quiser executar esse experimento; leva uma coleção e três mudanças de ambiente.
As letras miúdas que decidem se você economiza algo
O changelog é curto, mas três condições importam:
- Apenas solicitações diretas ao Gateway, não BYOK (Bring Your Own Key). Se você configurou o Bring Your Own Key para que o Gateway encaminhe solicitações em sua conta OpenAI, você será cobrado pelas taxas da OpenAI e a promoção não se aplica. Para obter o desconto, suas solicitações devem ser executadas nas chaves da Vercel, o que significa que o Gateway cuida da cobrança.
- Termina em 18 de setembro. As previsões orçamentárias baseadas em US$ 2,50/US$ 15 estarão erradas em 2x em outubro. Se você estiver fazendo algo único (um grande preenchimento, uma varredura de avaliação, uma re-rotulagem de conjunto de dados), a janela é um presente. Se você estiver definindo uma linha de base permanente de economia unitária, use o preço de tabela.
- O preço de tabela do Sol não mudou. A OpenAI não cortou o preço do Sol. Se você interpretar isso como um sinal sobre para onde os preços do Sol estão indo, isso é especulação; o único número comprometido é o da Vercel, e apenas até 18 de setembro.
Quando vale a pena pagar os preços do Sol
O desconto só importa se o Sol for a camada certa para o trabalho. A vantagem do Sol sobre Terra e Luna aparece na extremidade difícil da distribuição: tarefas de agente de longo prazo, orquestração complexa de ferramentas e, de acordo com testes recentes de terceiros, visão.
Os benchmarks da Roboflow publicados esta semana descobriram que o Sol atingiu 46,2 mAP@50 na detecção de objetos, acima dos 13,8 para o GPT-5.5, e 73% na contagem de objetos. A preços normais, essa capacidade custa cerca de 2,5 centavos por imagem. Durante a janela promocional, está mais perto de 1,2 centavos, o que transforma "executar o Sol em todo o nosso arquivo de documentos" de uma solicitação de orçamento em um experimento de uma tarde. Nosso resumo dos benchmarks do Sol tem os números mais amplos se você estiver decidindo entre as camadas.
O contraponto honesto dos mesmos dados da Roboflow: o Gemini 3.5 Flash ainda supera o Sol na detecção, custando 0,8 centavos por imagem. Um desconto diminui a diferença; não a apaga. Execute sua própria avaliação em seus próprios dados antes de se comprometer de qualquer forma.
A jogada para equipes de API
Se você constrói ou testa APIs para viver, aqui está a lista de verificação prática para o próximo mês:
- Antecipe o trabalho pesado com Sol. Varreduras de avaliação, geração de dados de teste sintéticos, passes de revisão de especificações, rascunhos de documentos: qualquer coisa que você executaria no Sol eventualmente, execute antes de 18 de setembro pela metade do custo.
- Faça um teste A/B das camadas enquanto o carro-chefe está barato. O argumento usual contra comparar Sol e Terra em sua carga de trabalho é que a própria comparação custa dinheiro. Agora, o Sol tem um preço próximo ao Terra, então o experimento é quase gratuito. Guarde os resultados; eles permanecem válidos após o término da promoção.
- Monitore seu painel de uso. O monitoramento de gastos do Gateway mostra o custo por modelo, então você verá a taxa com desconto refletida lá. Se seus números ainda mostrarem US$ 5/US$ 30, verifique se o BYOK não está silenciosamente direcionando você para sua própria conta OpenAI.
FAQ
Preciso alterar meu código para obter o desconto? Não. Se suas solicitações já passam pelo AI Gateway com a cobrança da Vercel, o desconto é aplicado automaticamente a partir de 17 de agosto. Novos usuários precisam de uma conta Vercel e uma chave de API do Gateway, então apontam qualquer cliente compatível com OpenAI para https://ai-gateway.vercel.sh/v1.
O desconto se aplica a tokens em cache e solicitações de contexto longo? Sim. O changelog da Vercel afirma que o desconto de 50% cobre tokens em cache, gravações em cache, solicitações de contexto longo e todas as regiões.
Isso se aplica se eu usar minha própria chave OpenAI (BYOK)? Não. As solicitações BYOK são cobradas pelas taxas do provedor OpenAI (US$ 5/US$ 30 para o Sol padrão) e são excluídas da promoção.
Isso é o mesmo que a OpenAI cortar o preço do Sol? Não. O preço de tabela da OpenAI para o Sol permanece inalterado. Este é um desconto da Vercel para o tráfego do Gateway por um mês. A última mudança que a própria OpenAI fez foi o corte de 30 de julho no Luna e Terra, que pulou o Sol.
Como verifico se estou obtendo Sol e não um modelo de fallback? O Gateway oferece suporte a roteamento e fallbacks de provedores, então fixe o modelo explicitamente como openai/gpt-5.6-sol e verifique o campo model no corpo da resposta. No Apidog, você pode adicionar uma asserção sobre esse campo a cada solicitação em sua coleção, para que um fallback silencioso falhe no teste em vez de cobrar silenciosamente por uma camada diferente. Se você ainda está escolhendo uma camada, nosso explicador o que é GPT-5.6 Sol aborda onde o carro-chefe justifica seu preço.
Vale a pena aproveitar, com um lembrete no calendário
Um desconto de 50% em um modelo carro-chefe sem markup subjacente é raro, e as condições são claras: roteie pelo Gateway, não use BYOK, termine até 18 de setembro. Antecipe o trabalho caro, execute a comparação de camadas que você estava adiando e defina o lembrete para quando a matemática reverter.
E antes que qualquer tráfego se mova, teste o endpoint como testaria qualquer outra dependência de API. O Apidog oferece a troca de ambiente, armazenamento secreto e asserções de resposta para trocar URLs base sem adivinhações. Experimente gratuitamente e aponte sua primeira coleção para o Gateway.
