GPT-Live Livre une Voix Full-Duplex sur ChatGPT

OpenAI logoOpenAIImportant9 juillet 2026Modèles
Ce qui s’est passé
OpenAI launched GPT-Live-1 (paid) and GPT-Live-1 mini (free) on July 8 — full-duplex voice models that listen and speak simultaneously, replacing Advanced Voice Mode across all ChatGPT tiers globally.
Pourquoi c’est important
This is the third generation of ChatGPT voice in two years, and it changes the interaction model fundamentally: from turn-based Q&A to continuous conversation with background reasoning via GPT-5.5. With 150M weekly voice users, it is the largest voice AI deployment ever.
Que faire
Paid users get GPT-Live-1 now. Free users get GPT-Live-1 mini. Try it — the continuous listening and natural interruption handling is the difference between a voice interface and a voice conversation. Developers: sign up for API access.

OpenAI a livré GPT-Live le 8 juillet — une paire de modèles vocaux full-duplex qui remplacent le Mode Vocal Avancé en tant que moteur conversationnel de ChatGPT. GPT-Live-1 (conditional) est destiné aux utilisateurs payants ; GPT-Live-1 mini (conditional) est déployé sur l'offre gratuite. Les deux écoutent et parlent simultanément, mettant fin à deux années d'IA vocale basée sur le tour de parole (OpenAI, 2026(s’ouvre dans un nouvel onglet)).

Ce qui s'est passé

L'ancien Mode Vocal Avancé (lancé en 2024) fusionnait le pipeline speech-to-text → LLM → text-to-speech en un seul modèle, mais les conversations restaient basées sur le tour de parole. Le modèle attendait que vous arrêtiez de parler. GPT-Live est différent : une architecture full-duplex qui traite l'entrée tout en générant la sortie — il peut écouter et parler en même temps.

Cela change le modèle d'interaction de trois façons :

  1. Interruption naturelle. Vous pouvez intervenir en milieu de réponse comme vous le feriez avec une personne. Le modèle gère la prise de parole de manière dynamique au lieu d'attendre la détection de fin de parole.
  2. Raisonnement en arrière-plan. GPT-Live délègue les tâches complexes — recherche web, raisonnement profond, travail agentique — à GPT-5.5 en arrière-plan tout en maintenant le flux conversationnel. Vous obtenez un « laissez-moi réfléchir » verbal au lieu d'un silence radio.
  3. Traduction en temps réel. Le pipeline full-duplex peut traduire simultanément plutôt que d'attendre que le locuteur termine une phrase.

OpenAI a décrit l'architecture comme un modèle full-duplex qui « traite en continu l'entrée tout en générant la sortie » (OpenAI, 2026(s’ouvre dans un nouvel onglet)).

Le déploiement s'accompagne d'une nouvelle infrastructure de sécurité. OpenAI a construit des évaluations de sécurité audio-natives et a soumis GPT-Live à des tests de red-teaming pour les risques spécifiques à la voix : automutilation, dépendance émotionnelle, violence et contenu sexuel.

Pourquoi c'est important

150 millions de personnes utilisent ChatGPT Voice chaque semaine. Le passage du mode tour de parole au full-duplex n'est pas une simple mise à jour de fonctionnalité — c'est une modalité différente. La différence entre « interroger un moteur de recherche » et « parler à un collègue » change ce pour quoi les gens utilisent l'IA vocale.

Pour les développeurs, la voie API s'ouvre. OpenAI a un formulaire d'inscription pour les développeurs qui souhaitent un accès programmatique à GPT-Live. Quand l'API arrivera, l'espace des agents vocaux — actuellement fragmenté entre Deepgram, ElevenLabs et des pipelines sur mesure — se consolidera autour d'un seul fournisseur exploitant le produit vocal grand public le plus populaire du marché.

Les deux modèles sont classés dans le répertoire comme conditional. La capacité full-duplex est réelle et livrée aujourd'hui — GPT-Live-1 obtient une préférence nette sur le Mode Vocal Avancé en termes de prise de parole, de flux conversationnel et de naturel dans les évaluations humaines en tête-à-tête, avec des gains solides sur les benchmarks GPQA, BrowseComp et τ³-Voice Telecom (OpenAI, 2026(s’ouvre dans un nouvel onglet)). Les conditions : pas encore d'accès API, et le support linguistique est inégal avec des lacunes d'accent et de fluidité pour certaines langues. Les benchmarks de latence tiers et la disponibilité de l'API détermineront quand les verdicts évolueront.

BenchmarkGPT-Live-1 vs. AVM
GPQA (raisonnement scientifique)Surpasse substantiellement le Mode Vocal Avancé
BrowseComp (recherche web agentique)Gains solides par rapport au Mode Vocal Avancé
τ³-Voice Telecom (tâches d'agent vocal)Surpasse le Mode Vocal Avancé

Ce que GPT-Live change pour vous

Si vous êtes sur ChatGPT Plus, Pro ou Go : GPT-Live-1 est votre nouveau modèle vocal. Il est livré avec une profondeur de raisonnement configurable — effort Instant, Medium ou High — et prend en charge les cartes de réponse visuelles et la traduction en temps réel. L'expressivité plus riche et le plafond de raisonnement plus élevé constituent une amélioration matérielle par rapport au Mode Vocal Avancé.

Si vous êtes sur l'offre gratuite : GPT-Live-1 mini offre la même architecture full-duplex avec GPT-5.5 Instant pour le raisonnement en arrière-plan. C'est un véritable pas en avant par rapport à l'ancien mode vocal basé sur le tour de parole, bien qu'il manque les niveaux d'effort de raisonnement Medium/High du modèle payant.

Si vous êtes développeur : Inscrivez-vous pour l'accès API. L'interface programmatique n'est pas encore disponible, mais le formulaire d'inscription est en ligne et OpenAI a confirmé qu'elle arrive. Quand elle sera disponible, attendez-vous à ce que le marché des agents vocaux se consolide rapidement autour d'un fournisseur comptant 150 millions d'utilisateurs vocaux actifs hebdomadaires.

FAQ

Est-ce un compagnon IA ? Non. Le système de sécurité d'OpenAI a spécifiquement testé GPT-Live contre la dépendance émotionnelle et le risque parasocial — des évaluations audio-natives pour l'automutilation, la psychose et la manie font partie du déploiement. Le modèle est conçu pour la conversation, pas pour la compagnie.

En quoi est-ce différent du Mode Vocal Avancé ? Le Mode Vocal Avancé était basé sur le tour de parole : vous arrêtiez de parler, puis le modèle répondait. GPT-Live est full-duplex : il écoute et parle simultanément, gérant l'interruption, la prise de parole et le raisonnement en arrière-plan de manière concurrente. C'est la différence architecturale entre un talkie-walkie et un appel téléphonique.

Quand l'API sera-t-elle disponible ? OpenAI n'a pas publié de date. Un formulaire d'inscription développeur est en ligne et le briefing produit a confirmé que l'accès programmatique arrive. En attendant, GPT-Live est exclusif à ChatGPT.

Outils et modèles concernés

Ne ratez plus jamais une mise à jour

Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.

En vous abonnant, vous acceptez notre Politique de confidentialité. Désabonnement à tout moment.