O ChatGPT Voz teve sua maior reformulação desde o lançamento do Modo de Voz Avançado. A partir de 8 de julho de 2026, o GPT-Live é o novo padrão: GPT-Live-1 para usuários pagantes nos planos Go, Plus e Pro, GPT-Live-1 mini para o nível Gratuito.
Se você usa a voz diariamente, duas perguntas importam: o que melhorou e o que você perdeu. Ambas as respostas são concretas, e uma delas é a razão pela qual você pode querer permanecer no Modo de Voz Avançado por mais um tempo.
A comparação em um relance
| Modo de Voz Avançado | GPT-Live | |
|---|---|---|
| Modelo de Conversa | Por turnos: fala depois que você para | Full-duplex: ouve enquanto fala |
| Interrupções | Suportadas, mas limites de turno falham | Contínuas; decide muitas vezes por segundo |
| Backchannels (“uhum”) | Não | Sim |
| Perguntas difíceis | Respondidas pelo próprio modelo de voz | Delegadas ao GPT-5.5 em segundo plano |
| Pesquisa na Web | Limitada | Pesquisa delegada, integrada à conversa |
| Tradução ao vivo | Básica | Suportada |
| Cartões visuais (clima, ações, esportes) | Não | Sim |
| Compartilhamento de vídeo e tela | Sim (assinantes elegíveis) | Não no lançamento |
| Disponibilidade | Permanece disponível | Padrão, lançamento global |
O que realmente melhorou
A alternância de turnos deixou de ser a interface. O Modo de Voz Avançado processava o áudio em um único modelo, o que reduzia a latência, mas as conversas ainda ocorriam em turnos discretos. Uma pausa para pensar ou um ruído de fundo podiam ser interpretados como "usuário terminou", fazendo com que o modelo interrompesse nos momentos errados. O GPT-Live processa a entrada continuamente enquanto gera a saída; ele espera enquanto você pensa, reconhece enquanto você explica e se recupera quando você o interrompe. Nas avaliações de usuários da OpenAI, as pessoas "preferiram fortemente" o GPT-Live em conversas diretas de 5 a 10 minutos.
O teto de inteligência foi elevado. O Modo de Voz Avançado respondia com sua própria capacidade. O GPT-Live delega: "quando uma pergunta exige pesquisa, raciocínio ou capacidades mais agentic", ele entrega a tarefa a um modelo mais forte, o GPT-5.5 no lançamento, e mantém a conversa até que a resposta retorne. A OpenAI relata que ele "supera substancialmente" o Modo de Voz Avançado no GPQA (perguntas científicas de nível especializado) e mostra "grandes ganhos" na pesquisa web agentic do BrowseComp. Relatado pelo fornecedor e não quantificado, mas a razão arquitetônica para acreditar é sólida: o teto agora é o do GPT-5.5, não o do modelo de voz.
A conversa ganhou elementos. Cartões visuais para clima, ações e esportes são exibidos na tela durante a conversa; imagens e arquivos podem entrar em um chat de voz; a memória é mantida.
O que você perde, por enquanto
Compartilhamento de vídeo e tela. A OpenAI afirma claramente: "No lançamento, o GPT-Live não suportará voz com vídeo ou compartilhamento de tela no ChatGPT, mas estamos trabalhando para introduzir essas capacidades em breve."
O Modo de Voz Avançado mantém ambos para assinantes elegíveis. Se seu fluxo de trabalho envolve apontar sua câmera para um aparelho quebrado, compartilhar sua tela para ajuda com depuração ou qualquer interação de "mostrar em vez de falar", o GPT-Live é um retrocesso hoje. Esta é a razão mais forte para adiar a mudança, e a OpenAI manteve os Modos de Voz Padrão e Avançado disponíveis em vez de forçar a migração.
Uma quantidade conhecida. As peculiaridades do Modo de Voz Avançado são documentadas e estáveis. O GPT-Live tem uma semana e está sendo lançado em fases; mudanças de comportamento nos primeiros dias são normais.
Quem deve mudar, quem deve esperar
Mude agora se seu uso de voz é para conversas, perguntas, tradução ou trabalho mãos-livres. A diferença do full-duplex não é sutil, e a delegação torna a voz viável para perguntas que você teria digitado antes. O caminho de configuração, incluindo seleção de variante e CarPlay, está em como usar o GPT-Live.
Espere se você usa compartilhamento de vídeo ou tela. Mantenha o Modo de Voz Avançado até que o "em breve" do GPT-Live seja lançado; você não perde nada esperando, já que o AVM permanece disponível e selecionável.
Usuários da camada gratuita não enfrentam a escolha: o GPT-Live-1 mini se torna o padrão, e ele traz o mesmo estilo de interação full-duplex com o GPT-5.5 Instant por trás.
O panorama geral
Este lançamento aposenta a era do walkie-talkie da IA de voz no assistente mais utilizado no mercado, e sua arquitetura, um front-end conversacional rápido delegando a um raciocínio profundo lento, é o padrão que os rivais agora precisam igualar. Como ele se compara à abordagem do Google é uma questão em aberto que abordamos em GPT-Live vs Gemini Live, onde a troca se inverte: o Gemini Live pode ver sua câmera e tela, e o GPT-Live o supera na conversa.
Para desenvolvedores, nada disso está na API ainda; a pilha de trabalho e a espera são abordadas em Existe uma API GPT-Live?. Se você está construindo agentes de voz na API em tempo real, enquanto isso, o Apidog cobre o teste de WebSocket e o mocking de backend que os projetos de voz sempre precisam; baixe-o gratuitamente para manter essas sessões inspecionáveis.
botão
FAQ
O Modo de Voz Avançado vai desaparecer? Não. A OpenAI manteve os Modos de Voz Padrão e Avançado disponíveis. O GPT-Live se torna o padrão, não a única opção.
Posso voltar para o Modo de Voz Avançado? Sim, a seleção do modo de voz permanece nas configurações de voz do ChatGPT, e os assinantes elegíveis mantêm os recursos de vídeo e compartilhamento de tela do AVM lá.
O GPT-Live suporta vídeo ou compartilhamento de tela? Não no lançamento. A OpenAI diz que essas capacidades chegarão ao GPT-Live "em breve"; até então, o AVM é a maneira de mantê-las.
O GPT-Live é mais inteligente que o Modo de Voz Avançado? Segundo a OpenAI: substancialmente melhor no raciocínio científico GPQA e mais forte na pesquisa web agentic, porque ele delega perguntas difíceis ao GPT-5.5 em vez de responder apenas com o modelo de voz. As pontuações não foram publicadas.
