Quando a OpenAI lançou o GPT-5.6 em 9 de julho de 2026, as manchetes foram para o Sol, o nível principal com o raciocínio mais aprofundado e os gráficos de benchmark. Leia o anúncio do GPT-5.6 além dos números do Sol, no entanto, e o modelo com o maior impacto na produção está uma linha abaixo. O GPT-5.6 Terra custa US$ 2,50 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída, e a OpenAI o posiciona como competitivo com o GPT-5.5 por aproximadamente metade do preço.
Essa única afirmação reformula o lançamento. Se o Terra se iguala ao GPT-5.5 em sua carga de trabalho, cada solicitação que você ainda direciona ao GPT-5.5 é um gasto desnecessário. O Terra não é o compromisso de orçamento da família; é a nova escolha de produção padrão. Sua chegada também marca o fim silencioso da jornada do GPT-5.5 como o modelo principal da OpenAI.
Este guia aborda o que é o Terra, como lidar com a migração do GPT-5.5, quando o Sol vale o dobro do preço, quando o Luna supera ambos e como fazer testes de regressão da troca antes que seus usuários a vejam.
TL;DR
gpt-5.6-terraé o nível equilibrado na família GPT-5.6, entre o carro-chefe Sol e o Luna focado em velocidade.- Preços: US$ 2,50 de entrada / US$ 15 de saída por 1M de tokens. A OpenAI posiciona o Terra como competitivo com o GPT-5.5 por aproximadamente metade do custo.
- Usuários gratuitos do ChatGPT agora recebem o Terra por padrão, um forte sinal da confiança da OpenAI neste nível.
- A migração do GPT-5.5 é "uma passagem de ajuste, não apenas uma mudança de slug do modelo", de acordo com a documentação da OpenAI: teste seu esforço de raciocínio atual e um nível abaixo, e espere saídas mais curtas.
- Todos os três níveis compartilham o conjunto completo de recursos: seis níveis de esforço de raciocínio, modo pro, cache de prompt explícito e os novos recursos da API de Respostas.
- Antes de virar a produção, execute seu conjunto de prompts salvos contra
gpt-5-5egpt-5.6-terrano Apidog e compare as saídas e contagens de tokens lado a lado.
O que é o GPT-5.6 Terra
O GPT-5.6 são três modelos em uma geração. Sol é o carro-chefe com o raciocínio mais aprofundado. Luna é o mais rápido e barato, construído para chamadas de alto volume e sensíveis à latência. Terra fica entre eles: profundidade de raciocínio suficiente para a maioria dos trabalhos de produção, com preço para superar o modelo que ele substitui. Os nomes dos níveis são duradouros, e a OpenAI diz que cada nível avançará em seu próprio ritmo a partir daqui. Terra é um caminho que você pode construir, não uma marca de lançamento única.
O ID do modelo é gpt-5.6-terra, e o acesso à API é self-service para qualquer conta de API. Sem lista de espera, sem restrição de plano. Um detalhe que vale a pena sinalizar: o alias simples gpt-5.6 roteia para o Sol, não para o Terra. Se você deseja o nível mais barato, nomeie-o explicitamente, ou uma configuração padrão preguiçosa dobrará sua conta sem alterar uma linha de código.
Aqui estão os preços da família por 1M de tokens:
| Modelo | Entrada | Saída | Posicionamento |
|---|---|---|---|
gpt-5.6-sol |
US$ 5,00 | US$ 30,00 | Carro-chefe, raciocínio mais aprofundado |
gpt-5.6-terra |
US$ 2,50 | US$ 15,00 | Equilibrado, saída de classe GPT-5.5 |
gpt-5.6-luna |
US$ 1,00 | US$ 6,00 | Mais rápido, trabalho de alto volume |
Compare esses números com a linha de base de preços do GPT-5.5 e a proposta se torna direta: a mesma classe de saída por cerca de metade da fatura. A OpenAI não está apresentando o Terra como um spin-off leve. Ela está apresentando o Terra como o modelo que torna seu carro-chefe anterior redundante em termos de preço.
Há mais um sinal escondido à vista. De acordo com o centro de ajuda da OpenAI, o Terra é agora o modelo que os usuários gratuitos e Go do ChatGPT recebem. A OpenAI colocou este nível na frente de sua maior e menos complacente audiência no primeiro dia. As empresas não fazem isso com um modelo em que hesitam.
Terra vs GPT-5.5: uma decisão de migração, não um buscar e substituir
A jogada tentadora é trocar a string do modelo e implantar. A própria documentação do desenvolvedor da OpenAI adverte exatamente contra isso: "Trate a migração como uma passagem de ajuste, não apenas uma mudança de slug do modelo."
Três comportamentos mudam sob você:
- O esforço de raciocínio mapeia de forma diferente. A OpenAI recomenda testar seu nível de esforço atual e um nível abaixo. O Terra com esforço reduzido pode igualar a qualidade de saída do seu GPT-5.5, enquanto reduz a latência e os tokens de saída, o que aumenta a vantagem de preço.
- As saídas ficam mais curtas. O GPT-5.6 escreve respostas mais concisas com menos introduções genéricas. Se seus prompts contiverem instruções como "seja conciso" ou "pule o preâmbulo", remova-as; diretivas de brevidade empilhadas em um modelo já breve podem cortar conteúdo que você queria manter.
- O cache merece ser verificado novamente. Observe o uso de tokens em cache durante sua janela de teste, especialmente se você adotar o novo modo de cache explícito abordado abaixo.
As especificações vêm com uma ressalva por enquanto. A cobertura da documentação inicial, incluindo o relatório do primeiro dia de Simon Willison, informa uma janela de contexto de 1M de tokens, saída máxima de 128K e um limite de conhecimento de 16 de fevereiro de 2026. Trate esses como números relatados até que as páginas de especificações da OpenAI se estabilizem.
O plano de migração prático é assim: retire de 20 a 50 tarefas representativas do tráfego de produção real, não prompts sintéticos. Execute-as contra o Terra em sua configuração de esforço atual e novamente um nível abaixo. Avalie as saídas em relação à sua linha de base GPT-5.5 e registre as contagens de tokens para cada execução. Se a qualidade se mantiver com o esforço menor, você economiza duas vezes, uma na taxa por token e outra em saídas mais curtas. Se degradar em uma rota específica, mantenha essa rota em um esforço maior em vez de abandonar a migração. O propósito de um modelo de metade do preço é perdido se você gastar as economias em regressões, então meça antes de mover.
Terra vs Sol: quando o carro-chefe vale o dobro
O Sol custa exatamente o dobro da taxa do Terra, US$ 5 / US$ 30 contra US$ 2,50 / US$ 15. O GPT-5.6 Sol é o nível que os benchmarks de lançamento da OpenAI descrevem, e os deltas são reais, segundo a OpenAI: aproximadamente 53 no Agents’ Last Exam contra 46,9 do GPT-5.5, 88,8% no Terminal-Bench 2.1 (91,9% com a configuração ultra), 73,5 no ExploitBench contra 47,9, e 62,6 no OSWorld 2.0 contra 47,5. Essas são alegações do dia do lançamento, e são também números do Sol. A OpenAI não publicou a mesma profundidade de dados de benchmark para o Terra, o que indica onde o prêmio de 2x reside: no limite máximo do trabalho agêntico.
Uma ressalva honesta cabe aqui: mesmo o Sol não lidera em todos os lugares. No SWE-Bench Pro, Claude Fable 5 atinge 80,3% contra 64,6% do Sol, de acordo com os mesmos materiais de lançamento. A fronteira é disputada neste ciclo, o que é mais um motivo para fazer benchmark de suas próprias tarefas em vez de confiar no gráfico de qualquer fornecedor.
Quando o Sol vale o dobro do preço?
- Codificação agêntica de longo horizonte, onde uma execução falha custa a tarde de um engenheiro.
- Orquestração de ferramentas em várias etapas, onde a profundidade do raciocínio se acumula ao longo das interações.
- Cargas de trabalho onde você ativaria o ultra, a configuração multiagente que executa quatro agentes em paralelo e troca gastos extras de tokens por resultados mais rápidos em tempo real. O Ultra está disponível no ChatGPT Work nos planos Pro e Enterprise, e no Codex a partir do Plus.
E quando não vale? Na maioria dos chats. Sumarização. Extração. Classificação com contexto. Respostas RAG, onde a qualidade da recuperação importa mais do que o limite do raciocínio. Para essas, o Terra pela metade do custo é o padrão racional. A aritmética é difícil de contestar: um serviço que processa 10M de tokens de entrada e 2M de tokens de saída por dia custa US$ 55 no Terra e US$ 110 no Sol. Ao longo de um mês, essa diferença é de US$ 1.650, o suficiente para financiar um conjunto sério de avaliações para as rotas onde você suspeita que o Sol pode importar.
Terra vs Luna: quando ir mais além
O Luna custa US$ 1 / US$ 6 por 1M de tokens, 60% abaixo do Terra. É o nível mais rápido, construído para trabalhos de alto volume e sensíveis à latência: classificação, extração, roteamento, rascunhos iniciais. Se a tarefa for específica e o prompt fizer o trabalho pesado, o Luna frequentemente te leva lá por menos da metade da taxa do Terra.
Um modelo mental útil: Terra é onde você começa, e Luna é para onde rotas individuais avançam depois que você tem avaliações provando que o nível mais barato se sustenta. Dividir o tráfego entre os níveis é uma operação normal agora, não uma otimização para depois. A comparação Sol vs Terra vs Luna detalha a decisão rota por rota, se você quiser a estrutura completa.
Cada nível recebe o conjunto completo de recursos
Rebaixar os níveis costumava significar perder capacidades. Não aqui. Todos os três modelos GPT-5.6 compartilham a mesma superfície:
- Seis níveis de esforço de raciocínio:
none(nenhum),low(baixo),medium(médio),high(alto),xhigh(muito alto),max(máximo). - Modo Pro (
reasoning.mode: "pro"), uma configuração com foco em qualidade disponível em todos os níveis. É um parâmetro, não um modelo separado. - Cache de prompt explícito: defina
prompt_cache_options.mode: "explicit"com um campottl. As gravações de cache são cobradas a 1,25x a taxa de entrada sem cache, as leituras de cache mantêm o desconto de 90%, e o conteúdo em cache vive por pelo menos 30 minutos. Para um agente ou chatbot com um prompt de sistema longo e estável, isso se soma ao preço base do Terra para empurrar o custo efetivo de entrada bem abaixo do preço de tabela. - As novas capacidades da API de Respostas: chamada programática de ferramentas, onde o modelo escreve JavaScript que orquestra chamadas de ferramentas dentro de um runtime V8 isolado sem acesso à rede; execução multiagente em beta; raciocínio persistido entre as turnos via
reasoning.context; e configurações de detalhes de visão (original/auto) que preservam as dimensões originais da imagem.
A consequência é clara: a escolha do nível é puramente uma decisão de preço versus profundidade. Você nunca abre mão de um recurso da API ao escolher o Terra.
Uma chamada mínima do Terra através da API de Respostas se parece com isto:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"reasoning": { "effort": "low" },
"input": "Resuma este tópico de suporte e sinalize qualquer solicitação de reembolso."
}'
Teste de regressão da troca antes que a produção a veja
A lista de verificação de migração acima funciona apenas se você puder comparar as execuções de forma limpa, e isso é um problema de ferramentas antes de ser um problema de modelo. Baixe o Apidog e o fluxo de trabalho levará uma tarde:
- Salve sua solicitação da API de Respostas uma vez, com o nome do modelo como uma variável de ambiente em vez de uma string codificada.
- Crie dois ambientes: um define a variável como
gpt-5-5, o outro comogpt-5.6-terra. - Execute seu conjunto de prompts salvos contra cada ambiente e compare as respostas lado a lado.
- Leia os campos de
usageem cada resposta: tokens de entrada, tokens de saída e tokens em cache informam o que a troca custa, não o que a página de preços implica.
Espere que as respostas do Terra sejam mais curtas que as do GPT-5.5 nos mesmos prompts. Isso é por design, mas tem consequências a jusante: parsers que assumem um comprimento mínimo, UIs que preenchem respostas curtas de forma estranha, orçamentos de tokens ajustados para o modelo antigo. A comparação de contagem de tokens é a etapa que a maioria das equipes pula, e é a etapa que decide a verdadeira economia da migração.
Assim que o Terra passar em seu conjunto de prompts, adicione um terceiro ambiente para gpt-5.6-luna e execute novamente as rotas baratas. As mesmas solicitações salvas respondem à próxima pergunta de custo antes que alguém a faça.
FAQ
O GPT-5.6 Terra é melhor que o GPT-5.5?
A OpenAI posiciona o Terra como competitivo com o GPT-5.5, não estritamente melhor, por aproximadamente metade do preço. Para a maioria das cargas de trabalho, a troca é qualidade comparável com saídas mais curtas e uma conta menor. A resposta honesta para sua pilha vem da avaliação de suas próprias tarefas representativas antes de você mudar o tráfego.
Quanto custa o GPT-5.6 Terra?
US$ 2,50 por 1M de tokens de entrada e US$ 15 por 1M de tokens de saída, com as leituras de cache mantendo um desconto de 90% sob o novo modo de cache explícito. Para a economia completa da família, incluindo Sol, Luna e a matemática do cache, veja o detalhamento de preços do GPT-5.6.
Quais planos do ChatGPT incluem o Terra?
Todos eles. Usuários gratuitos e Go recebem o Terra como seu modelo. Os planos Plus e superiores podem escolher entre Sol, Terra e Luna e definir um nível de esforço de raciocínio por modelo, com o Sol disponível a partir do esforço médio no Plus.
Preciso de mudanças no código para usar o Terra?
O formato da chamada não foi alterado; o Terra funciona com sua integração existente da API de Respostas, e os IDs do modelo são confirmados na documentação do desenvolvedor da OpenAI. O que precisa de atenção é o ajuste: reteste seu nível de esforço de raciocínio, remova diretivas de brevidade dos prompts e confirme se o código a jusante lida com saídas mais curtas.
O padrão mudou
O GPT-5.5 não está depreciado hoje, mas sua economia sim. Quando o mesmo fornecedor vende saída comparável pela metade do preço, permanecer onde está é uma decisão que você deve ser capaz de defender com dados, e a maioria das equipes não será capaz. O Terra é o novo ponto de partida: comece por lá, promova rotas agênticas complexas para o Sol quando as avaliações exigirem, e rebaixe rotas de alto volume e estreitas para o Luna quando elas passarem.
O próximo passo é pequeno. Pegue 20 prompts reais de seus logs de produção, execute-os contra gpt-5-5 e gpt-5.6-terra no Apidog, e deixe que as saídas e contagens de tokens tomem a decisão. Capacidade pela metade do preço é uma afirmação até que suas próprias avaliações a confirmem, e confirmá-la custa uma tarde.
