- 01OpenAI déploie GPT-Live-1 et GPT-Live-1 mini, modèles vocaux full-duplex capables de parler et écouter simultanément, réduisant les interruptions involontaires.
- 02Les nouveaux modèles routent les requêtes vers GPT-5.5 pour le raisonnement et la recherche, et peuvent présenter les réponses en format visuel.
- 03GPT-Live-1 mini remplace par défaut l'Advanced Voice Mode ; les utilisateurs payants accèdent à GPT-Live-1, conçu pour des conversations de 30 à 40 minutes.

OpenAI a présenté deux nouveaux modèles vocaux, GPT-Live-1 et GPT-Live-1 mini, conçus pour des conversations plus naturelles en temps réel. Ces modèles full-duplex permettent à l'IA de parler et d'écouter simultanément, autorisant l'utilisateur à interrompre naturellement et activant des fonctionnalités comme la traduction en direct.
L'architecture précédente d'OpenAI combinait trois étapes distinctes : transcription vocale, génération de réponse par un grand modèle de langage, puis synthèse vocale. Les nouveaux modèles unifient ce processus et résolvent deux problèmes majeurs : l'interruption involontaire de l'utilisateur et une capacité de raisonnement insuffisante. GPT-Live-1 peut désormais router les requêtes vers des modèles textuels plus puissants comme GPT-5.5 pour la recherche, le raisonnement ou les capacités agentiques, tout en maintenant la conversation. Le modèle peut également rester silencieux longtemps, absorbant le contexte jusqu'à être sollicité.
OpenAI remplace par défaut l'Advanced Voice Mode actuel de ChatGPT par GPT-Live-1 mini pour tous les utilisateurs. Les abonnés aux tiers payants accèdent au modèle plus large, GPT-Live-1. Selon Atty Eleti, responsable produit de ChatGPT Voice, le modèle est conçu pour des conversations longues, avec des tests internes montrant des échanges de 30 à 40 minutes. Le modèle peut aussi présenter les informations en format visuel, complétant les réponses vocales.
OpenAI souligne que plus de 150 millions de personnes utilisent déjà ChatGPT via des fonctionnalités vocales. La direction envisage la voix comme interface primaire pour les tâches informatiques complexes et les travaux agentiques de longue durée, comparable aux usages actuels de Codex et ChatGPT.
Articles liés

ChatGPT refuse désormais de cloner les styles d'auteurs vivants
Comprenez les nouvelles limites de ChatGPT concernant l'imitation de styles d'auteurs et leurs implications juridiques.

ChatGPT Voice arrive sur l'application desktop d'OpenAI
Les utilisateurs de ChatGPT peuvent désormais interagir vocalement via l'application desktop pour automatiser des tâches ou contrôler des agents.

OpenAI développe un haut-parleur IA sans écran pour interagir avec ChatGPT
Découvrir les détails du premier appareil hardware d'OpenAI, conçu pour interagir avec ChatGPT sans écran.