GPT-6.1 Sol é o mais novo modelo Sol da OpenAI, lançado no DevDay em 29 de setembro de 2026, com o ID do modelo da API gpt-6.1-sol. Ele custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, o mesmo preço de tabela do GPT-6 Sol, mas a entrada em cache cai de US$ 0,20 para US$ 0,10. Ele aceita até 922.000 tokens de entrada em uma janela de contexto de 1.050.000 tokens, gera até 128.000 tokens e tem um corte de conhecimento em 30 de abril de 2026. A OpenAI o apresenta como "inteligência quase Astra" a um quinto dos preços de token padrão do GPT-6 Astra.
Este explicativo abrange a disponibilidade, preços, especificações, reivindicações de benchmark da OpenAI e quando o GPT-6 Astra ainda é a melhor escolha. Para tudo o mais que a OpenAI lançou naquele dia, consulte o resumo do DevDay 2026; para o modelo que ele sucede, leia o que é o GPT-6 Sol. Você pode enviar sua primeira solicitação gpt-6.1-sol do Apidog e mantê-la como um teste salvo.
GPT-6.1 Sol em resumo
| Especificação | GPT-6.1 Sol |
|---|---|
| ID do Modelo | gpt-6.1-sol (snapshot único); OpenRouter: openai/gpt-6.1-sol |
| Janela de contexto | 1.050.000 tokens |
| Entrada / saída máxima | 922.000 / 128.000 tokens |
| Corte de conhecimento | 30 de abril de 2026 |
| Esforço de raciocínio | low, medium (padrão), high, xhigh, max; não none ou minimal |
| Modalidades | Texto e imagem de entrada, texto de saída |
| Endpoints | Chat Completions, Responses, Batch (não Realtime, Live, Assistants ou fine-tuning) |
| Ferramentas integradas | web_search, file_search, code_interpreter, computer_use, apply_patch, hosted_shell, mcp, tool_search, image_generation, skills |
| Limites de taxa | Camada 1: 500 RPM, 500K TPM; Camada 5: 15.000 RPM, 40M TPM |
Fonte: a página do modelo GPT-6.1 Sol. A janela e o limite de entrada correspondem ao que a página do modelo GPT-6 Sol lista hoje, então o tamanho do contexto não é a atualização.
Onde você pode usar o GPT-6.1 Sol
A publicação de lançamento da OpenAI o disponibiliza “para todos os usuários Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e Codex”, e acrescenta que “ainda não está disponível no Chat”. As versões Free e Go não estão na lista, e a documentação de modelos da OpenAI diz que Enterprise e Edu o mantêm desativado até que um administrador o ative. Na API, é gpt-6.1-sol em Chat Completions, Responses e Batch, cobrado por token, e o OpenRouter o serve como openai/gpt-6.1-sol com as mesmas taxas de tabela em seu endpoint OpenAI.
Não há camada de API gratuita. O guia gratuito do GPT-6.1 Sol classifica as rotas mais baratas e nomeia uma alternativa gratuita (um modelo diferente).
Preços do GPT-6.1 Sol
Todos os preços são por milhão de tokens, da página de preços da OpenAI, para prompts de até 272K tokens de entrada:
| Modelo e camada | Entrada | Entrada em cache | Escrita de cache | Saída |
|---|---|---|---|---|
| GPT-6.1 Sol, Padrão | US$ 2,00 | US$ 0,10 | US$ 2,50 | US$ 10,00 |
| GPT-6.1 Sol, Batch ou Flex | US$ 1,00 | US$ 0,05 | US$ 1,25 | US$ 5,00 |
| GPT-6.1 Sol, Rápido | US$ 4,00 | US$ 0,20 | US$ 5,00 | US$ 20,00 |
| GPT-6 Sol, Padrão | US$ 2,00 | US$ 0,20 | US$ 2,50 | US$ 10,00 |
| GPT-6 Astra, Padrão | US$ 10,00 | US$ 1,00 | US$ 12,50 | US$ 50,00 |
| GPT-6 Astra, Ultrafast | US$ 60,00 | US$ 6,00 | US$ 75,00 | US$ 300,00 |
| GPT-6 Luna, Padrão | US$ 0,10 | US$ 0,01 | US$ 0,125 | US$ 0,50 |
O Ultrafast para GPT-6.1 Sol está “chegando em breve”, sem preço ainda. Três coisas se destacam na tabela.
Por token, a atualização é gratuita. Os preços de tabela de entrada e saída correspondem exatamente ao GPT-6 Sol. A única taxa que mudou é a entrada em cache, que a OpenAI precifica em “US$ 0,10 por milhão de tokens, 95% menos do que o preço de entrada padrão e 50% menos do que o preço de entrada em cache do GPT-6 Sol”. Reutilize um prompt de sistema longo, esquemas de ferramentas ou contexto de repositório, e essa linha da sua conta cai pela metade. A contagem de tokens de saída pode mudar com um novo modelo, então meça antes de prometer economias. O guia de cache de prompt do GPT-6 mostra como estruturar prompts que atingem o cache.
Prompts longos custam mais. Após 272K tokens de entrada, a página do modelo diz que a requisição inteira é cobrada a 2x as taxas de entrada e cache e 1,5x a taxa de saída: US$ 4 de entrada, US$ 0,20 em cache e US$ 15 de saída no Padrão. Você pode enviar 922K tokens, mas paga o dobro na entrada para fazer isso.
Astra custa cinco vezes mais. O GPT-6 Astra custa US$ 10/US$ 50, cinco vezes as taxas padrão do 6.1 Sol, de onde vem a formulação “um quinto” da OpenAI. Astra também é o único modelo com Ultrafast amplamente disponível hoje, a 6x seu preço Padrão.
O que mudou do GPT-6 Sol
| GPT-6 Sol | GPT-6.1 Sol | |
|---|---|---|
| ID do Modelo | gpt-6-sol |
gpt-6.1-sol |
| Entrada / saída por 1M | US$ 2 / US$ 10 | US$ 2 / US$ 10 |
| Entrada em cache por 1M | US$ 0,20 | US$ 0,10 |
| Níveis de esforço | none até max |
low até max |
| Corte de conhecimento | 20 de abril de 2026 | 30 de abril de 2026 |
A página do modelo GPT-6 Sol agora diz “Veja GPT-6.1 Sol para o modelo Sol mais recente”. A mudança custa duas coisas. Qualquer solicitação que envie reasoning: {"effort": "none"} precisa de um novo valor: mova-o para low, o nível mais baixo que o 6.1 Sol aceita, e execute novamente suas avaliações, porque low ainda raciocina e os tokens de raciocínio são cobrados como saída. O corte de conhecimento também avança dez dias. O guia da API GPT-6.1 Sol descreve a migração com exemplos de solicitação.
Benchmarks do GPT-6.1 Sol: o que a OpenAI afirma
Cada número nesta seção vem da publicação de lançamento da OpenAI: a OpenAI executou seus próprios modelos e diz que os resultados dos concorrentes vêm de relatórios publicamente disponíveis. A OpenAI publica as pontuações brutas como gráficos; os deltas abaixo são os que ela afirma no texto. Os custos são o custo por tarefa no esforço declarado.
| Benchmark | O que a OpenAI diz sobre o GPT-6.1 Sol |
|---|---|
| DeepSWE v1.1 | Corresponde ao Astra “a aproximadamente um quinto do custo”; supera a melhor pontuação do GPT-6 Sol em 6,4 pp com menor esforço e custo |
| GDP.pdf | Maior que Opus 5.5 “com fallbacks a menos da metade do custo por tarefa”; aproxima-se do Astra a cerca de um quinto do custo por tarefa |
| AutomationBench 1.0.6 | +2,2 pp sobre Opus 5.5 com esforço médio por aproximadamente um terço do custo; +4,8 pp sobre GPT-6 Sol na mesma configuração |
| OSWorld 2.0 offline (recompensa parcial) | +7 pp sobre GPT-6 Sol com esforço máximo por menos da metade do custo; dentro de 2,1 pp do Astra no máximo por cerca de um sétimo do custo por tarefa |
| Terminal-Bench Science 0.1 | Mais que o dobro do GPT-6 Sol com esforço máximo; US$ 5,47 por tarefa vs US$ 23,21 para Opus 5.5 e US$ 23,80 para Astra |
| Factualidade (conversas com erros sinalizados) | Com baixo esforço, a parcela de respostas com erros cai de 11,4% (GPT-6 Sol) para 7,7%, cerca de 32% menos; dentro de 1,9 pp do Astra a menos de um quinto do custo por tarefa |
Leia a tabela com três ressalvas:
- Os oponentes são Opus 5.5 e Fable 5.1, não Claude Sonnet 5.5, que foi lançado um dia antes com o mesmo preço de US$ 2/US$ 10. Nenhum fornecedor publicou um comparativo direto 6.1 Sol vs Sonnet 5.5; o guia GPT-6.1 Sol vs Claude Sonnet 5.5 mostra como executar um com seus próprios prompts. No AutomationBench, a OpenAI também observa que o ponto de custo do Fable 5.1 omite os fallbacks, que ocorreram em cerca de 40% das tarefas.
- A proposta é custo por tarefa, não pontuação máxima. A maioria das linhas diz “corresponde” ou “aproxima-se” do Astra a uma fração do custo. Forte para orçamentos, mais fraco se você precisar da pontuação máxima.
- A factualidade foi medida em conversas que os usuários sinalizaram por erros, não em uso típico.
Astra ainda vence um teste principal. No Terminal-Bench Science, a OpenAI diz que Astra ainda pontua mais alto, com 68,1%, e recomenda Astra para o trabalho científico mais difícil.
Quando o GPT-6 Astra ainda é a melhor opção
Para a maioria das cargas de trabalho de codificação e agentes que rodavam no GPT-6 Sol, o 6.1 Sol é uma troca direta pelo mesmo preço. Mantenha o Astra quando:
- A tarefa for o trabalho científico ou de terminal mais difícil. Essa é a própria orientação da OpenAI após o Terminal-Bench Science.
- Você precisa do Ultrafast hoje. O Astra Ultrafast está ativo na API e no ChatGPT Work e Codex no Pro 500 e Enterprise. O do 6.1 Sol está “chegando em breve”.
- Você está construindo com a ferramenta computer-use da API de Agentes. Sua documentação nomeia apenas
gpt-6-astra. A página do modelo 6.1 Sol listacomputer_usecomo uma ferramenta, então verifique a documentação da API de Agentes antes de mover um agente. - Os últimos dois pontos importam mais do que uma diferença de custo de 5x. No OSWorld e na factualidade, o Astra permanece cerca de 2 pp à frente.
Na outra direção, o GPT-6 Luna a US$ 0,10/US$ 0,50 cobre classificação e extração de alto volume onde o raciocínio de nível Sol é excessivo. A comparação Luna vs Sol vs Astra detalha o custo por tarefa por camada, e o guia da API GPT-6 Astra aborda os parâmetros do Astra.
Chame o GPT-6.1 Sol e verifique os custos
Aqui está uma primeira solicitação na API Responses, com a chave lida de uma variável de ambiente:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "low"},
"input": "List three ways to make a webhook receiver idempotent."
}'
A resposta contém um objeto usage com input_tokens, output_tokens e output_tokens_details.reasoning_tokens. O guia de raciocínio da OpenAI diz que os tokens de raciocínio são cobrados como saída, então o esforço altera sua conta mesmo quando a resposta visível tem o mesmo comprimento. Acertos de cache aparecem em input_tokens_details.cached_tokens.
Para transformar isso em uma verificação repetível no Apidog:
- Crie um ambiente com
OPENAI_API_KEYeMODEL_IDdefinidos comogpt-6.1-sol. EnvieBearer {{OPENAI_API_KEY}}no cabeçalho Authorization e"model": "{{MODEL_ID}}"no corpo. - Salve a solicitação como um POST para
https://api.openai.com/v1/responses. - Adicione asserções: status é 200,
$.usage.output_tokensé maior que 0, e$.usage.output_tokens_details.reasoning_tokenspermanece abaixo de um limite que você escolher para este prompt. - Coloque um prefixo fixo de pelo menos 1.024 tokens (o comprimento mínimo armazenável em cache no guia de cache de prompt) no início de
input, envie duas vezes e afirme que$.usage.input_tokens_details.cached_tokensé maior que 0 na segunda execução. - Clone o ambiente com
MODEL_IDdefinido comogpt-6-sole execute a mesma solicitação em ambos. Mesmo prompt, dois modelos,usagelado a lado.
FAQ
O GPT-6.1 Sol é gratuito? Não. Ele está disponível no ChatGPT Work e Codex para usuários Plus, Pro, Business, Enterprise e Edu, e a API não possui uma camada gratuita. O guia gratuito do GPT-6.1 Sol abrange as rotas de menor custo.
Qual é o ID do modelo GPT-6.1 Sol? gpt-6.1-sol, um único snapshot. No OpenRouter é openai/gpt-6.1-sol.
O GPT-6.1 Sol suporta esforço de raciocínio none? Não. Ele aceita low, medium (o padrão), high, xhigh e max. As solicitações que enviavam none para o GPT-6 Sol precisam de um novo valor.
O GPT-6.1 Sol é melhor que o GPT-6 Astra? Não em todos os aspectos. A OpenAI diz que ele corresponde ou se aproxima do Astra em vários benchmarks com um quinto a um sétimo do custo por tarefa, mas o Astra ainda lidera o Terminal-Bench Science com 68,1%.
Próximo passo
Se você usa o GPT-6 Sol hoje, altere o ID do modelo, substitua qualquer esforço none por low, e compare o usage em alguns prompts reais antes de mudar o tráfego de produção. Baixe o Apidog para manter ambas as execuções como solicitações salvas com asserções, então siga o guia da API GPT-6.1 Sol para a lista de verificação completa da migração.
