Aller au contenu principal

GPT-Live : la voix qui écoute et parle en même temps

Mis à jour le 28 juillet 2026

Le 8 juillet 2026, OpenAI a lancé GPT-Live, une nouvelle génération de modèles vocaux qui remplace le moteur de ChatGPT Voice. Le mot « remplace » est à prendre au sérieux : il ne s’agit pas d’une amélioration incrémentale du moteur existant, mais d’un changement d’architecture. Et comme souvent, c’est en comprenant ce que faisait l’ancienne architecture qu’on mesure ce que la nouvelle apporte.

Full-duplex : ce que ça veut dire

Les générations précédentes d’assistants vocaux fonctionnaient en tour par tour : vous parlez, le système attend que vous ayez fini, il répond, vous attendez qu’il ait fini, et ainsi de suite. Certaines reposaient même sur une cascade de trois modèles — transcription de votre voix en texte, traitement par un LLM, puis synthèse vocale de la réponse — avec les pertes d’information et les pauses que chaque maillon ajoutait. Cette rigidité, tout utilisateur d’assistant vocal l’a ressentie : impossible d’interrompre naturellement, impossible de réfléchir à voix basse sans que le système croie que c’est son tour.

GPT-Live repose sur une architecture full-duplex : le modèle peut écouter et parler simultanément, comme le fait un interlocuteur humain. En pratique, cela change la texture même de la conversation. Pendant que vous parlez, GPT-Live peut manifester qu’il suit — un « mhmm », un « oui » glissé au bon moment — sans vous couper. Quand vous l’interrompez au milieu d’une phrase, il gère l’échange rapide naturellement, au lieu de terminer obstinément sa tirade. Et quand vous marquez une pause pour réfléchir, il sait rester silencieux sans considérer que la conversation est terminée. Ce sont trois comportements que le tour par tour rendait structurellement impossibles.

L’intelligence en arrière-plan

Un point d’architecture mérite d’être compris pour ne pas se méprendre sur ce qu’est GPT-Live : il ne raisonne pas tout seul sur les questions difficiles. Quand une requête demande une recherche web, un raisonnement approfondi ou un travail complexe, GPT-Live délègue à un modèle frontière en coulisses et ramène le résultat dans la conversation. La partie remarquable est qu’il continue à vous parler pendant que ce travail s’exécute — la conversation ne se fige pas en attendant la réponse. Au lancement, le modèle utilisé en arrière-plan est GPT-5.5, et OpenAI indique qu’il sera mis à jour au fil des sorties de nouveaux modèles frontière. Autrement dit, GPT-Live est la couche conversationnelle ; l’intelligence de fond, elle, suivra son propre rythme d’évolution.

Disponibilité au 28 juillet 2026

ÉlémentÉtat au 28 juillet 2026
ModèlesGPT-Live-1 et GPT-Live-1 mini
ChatGPTDéploiement mondial en cours depuis le 8 juillet
APIAnnoncée « prochainement », inscription via formulaire

Pour les développeurs d’applications vocales, la dernière ligne de ce tableau est la plus importante : l’API n’est pas encore disponible. Si vous construisez aujourd’hui un agent vocal sur l’API temps réel existante, ne planifiez pas votre architecture en supposant que le full-duplex arrivera comme une simple mise à jour de l’existant : il arrivera comme une nouvelle génération, avec l’inscription via formulaire comme seul point d’entrée pour l’instant.

Ce que cela change pour vos usages

Pour la formation, le support client vocal ou l’accompagnement mains libres, le full-duplex lève le principal irritant des assistants vocaux : la rigidité du tour par tour. Un formateur qui utilise le mode vocal pour simuler un entretien, par exemple, retrouvera enfin le rythme d’un vrai échange — interruptions, relances, silences — au lieu d’une alternance mécanique de monologues. Les cours de ce site consacrés au mode vocal de ChatGPT décrivent l’expérience d’avant juillet 2026 ; le fonctionnement de fond qu’ils enseignent — commandes, cas d’usage — reste valable, la fluidité en plus.

Source officielle : Introducing GPT-Live

Points clés à retenir

  • GPT-Live est full-duplex : il écoute et parle en même temps
  • Deux modèles : GPT-Live-1 et GPT-Live-1 mini, déployés mondialement dans ChatGPT
  • Les questions complexes sont déléguées à un modèle frontière (GPT-5.5 au lancement)
  • L’API est annoncée mais pas encore disponible au 28 juillet 2026