ChatGPT Voice a connu sa plus grande refonte depuis le lancement du Mode Vocal Avancé. À compter du 8 juillet 2026, GPT-Live est le nouveau mode par défaut : GPT-Live-1 pour les utilisateurs payants sur Go, Plus et Pro, GPT-Live-1 mini pour le niveau Gratuit.
Si vous utilisez la voix quotidiennement, deux questions importent : qu'est-ce qui est mieux, et qu'avez-vous perdu. Les deux réponses sont concrètes, et l'une d'elles est la raison pour laquelle vous pourriez vouloir rester sur le Mode Vocal Avancé un peu plus longtemps.
La comparaison en un coup d'œil
| Mode Vocal Avancé | GPT-Live | |
|---|---|---|
| Modèle de conversation | Basé sur les tours : parle après que vous ayez cessé de parler | Full-duplex : écoute tout en parlant |
| Interruptions | Prises en charge, mais les limites de tour sont mal détectées | Continues ; décision prise plusieurs fois par seconde |
| Canaux secondaires (« mhmm ») | Non | Oui |
| Questions difficiles | Répondues par le modèle vocal lui-même | Déléguées à GPT-5.5 en arrière-plan |
| Recherche web | Limitée | Recherche déléguée, intégrée à la conversation |
| Traduction en direct | Basique | Prise en charge |
| Cartes visuelles (météo, actions, sports) | Non | Oui |
| Partage de vidéo et d'écran | Oui (abonnés éligibles) | Pas au lancement |
| Disponibilité | Reste disponible | Par défaut, déploiement mondial |
Ce qui s'est réellement amélioré
La prise de parole en alternance n'est plus l'interface. Le Mode Vocal Avancé traitait l'audio dans un seul modèle, ce qui réduisait la latence, mais les conversations se déroulaient toujours par tours discrets. Une pause de réflexion ou un bruit de fond pouvait être interprété comme « l'utilisateur a fini », de sorte que le modèle interrompait au mauvais moment. GPT-Live traite l'entrée en continu tout en générant une sortie ; il attend pendant que vous réfléchissez, accuse réception pendant que vous expliquez, et se rattrape lorsque vous parlez par-dessus. Dans les évaluations des utilisateurs d'OpenAI, les gens ont « fortement préféré » GPT-Live lors de conversations en tête-à-tête de 5 à 10 minutes.
Le plafond d'intelligence a été levé. Le Mode Vocal Avancé répondait à partir de ses propres capacités. GPT-Live délègue : « lorsqu'une question nécessite une recherche, un raisonnement ou des capacités plus agissantes », il confie la tâche à un modèle plus puissant, GPT-5.5 au lancement, et maintient la conversation en cours jusqu'à ce que la réponse revienne. OpenAI rapporte qu'il « surpasse substantiellement » le Mode Vocal Avancé sur GPQA (questions scientifiques de niveau expert) et montre de « forts gains » sur la recherche web agissante de BrowseComp. Rapporté par le fournisseur et non quantifié, mais la raison architecturale de croire en sa validité est solide : le plafond est maintenant celui de GPT-5.5, et non celui du modèle vocal.
La conversation s'est enrichie. Des cartes visuelles pour la météo, les actions et les sports s'affichent à l'écran en pleine conversation ; des images et des fichiers peuvent être intégrés à un chat vocal ; la mémoire est conservée.
Ce que vous perdez, pour l'instant
Partage de vidéo et d'écran. OpenAI le dit clairement : « Au lancement, GPT-Live ne prendra pas en charge la voix avec le partage de vidéo ou d'écran dans ChatGPT, mais nous travaillons à introduire ces capacités prochainement. »
Le Mode Vocal Avancé conserve les deux pour les abonnés éligibles. Si votre flux de travail implique de pointer votre caméra vers un appareil en panne, de partager votre écran pour de l'aide au débogage, ou toute interaction de type « montrer, ne pas dire », GPT-Live est une régression aujourd'hui. C'est la raison la plus forte de retarder le passage, et OpenAI a maintenu les modes vocal Standard et Avancé disponibles plutôt que de forcer la migration.
Un comportement connu. Les particularités du Mode Vocal Avancé sont documentées et stables. GPT-Live a une semaine et est déployé par étapes ; les changements de comportement des premiers jours sont normaux.
Qui devrait passer au nouveau mode, qui devrait attendre
Passez maintenant si votre utilisation vocale concerne la conversation, les questions, la traduction ou le travail mains libres. La différence full-duplex n'est pas subtile, et la délégation rend la voix viable pour des questions que vous auriez auparavant tapées. Le chemin de configuration, y compris la sélection de la variante et CarPlay, se trouve dans comment utiliser GPT-Live.
Attendez si vous utilisez le partage de vidéo ou d'écran. Conservez le Mode Vocal Avancé jusqu'à ce que le « bientôt » de GPT-Live soit livré ; vous ne perdez rien à attendre, car l'AVM reste disponible et sélectionnable.
Les utilisateurs du niveau gratuit n'ont pas le choix : GPT-Live-1 mini devient le mode par défaut, et il offre le même style d'interaction full-duplex avec GPT-5.5 Instant en arrière-plan.
Le tableau d'ensemble
Cette version met fin à l'ère du talkie-walkie de l'IA vocale dans l'assistant le plus largement utilisé sur le marché, et son architecture, un frontal conversationnel rapide déléguant à un raisonnement profond et lent, est le modèle que les rivaux doivent maintenant égaler. La façon dont il se compare à l'approche de Google est une question actuelle que nous abordons dans GPT-Live vs Gemini Live, où le compromis s'inverse : Gemini Live peut voir votre caméra et votre écran, et GPT-Live le surpasse en conversation.
Pour les développeurs, rien de tout cela n'est encore dans l'API ; la pile de travail et l'attente sont abordées dans Existe-t-il une API GPT-Live ?. Si vous construisez des agents vocaux sur l'API temps réel en attendant, Apidog couvre les tests WebSocket et le mocking de backend dont les projets vocaux ont toujours besoin ; téléchargez-le gratuitement pour garder ces sessions inspectables.
FAQ
Le Mode Vocal Avancé va-t-il disparaître ? Non. OpenAI a maintenu les modes vocal Standard et Avancé disponibles. GPT-Live devient le mode par défaut, pas la seule option.
Puis-je revenir au Mode Vocal Avancé ? Oui, la sélection du mode vocal reste dans les paramètres vocaux de ChatGPT, et les abonnés éligibles y conservent les fonctionnalités de partage de vidéo et d'écran de l'AVM.
GPT-Live prend-il en charge le partage de vidéo ou d'écran ? Pas au lancement. OpenAI affirme que ces capacités arriveront sur GPT-Live « prochainement » ; d'ici là, l'AVM est le moyen de les conserver.
GPT-Live est-il plus intelligent que le Mode Vocal Avancé ? Selon OpenAI : nettement meilleur en raisonnement scientifique GPQA et plus performant en recherche web agissante, car il délègue les questions difficiles à GPT-5.5 plutôt que de répondre uniquement à partir du modèle vocal. Les scores n'ont pas été publiés.
