watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

OpenAI lance GPT-Live-1, ses nouveaux modèles vocaux full-duplex pour ChatGPT

mercredi 8 juillet 202617:002 min de lecture2 sources citées
L'essentiel — 3 points
  • 01OpenAI déploie GPT-Live-1 et GPT-Live-1 mini, modèles vocaux full-duplex capables de parler et écouter simultanément, réduisant les interruptions involontaires.
  • 02Les nouveaux modèles routent les requêtes vers GPT-5.5 pour le raisonnement et la recherche, et peuvent présenter les réponses en format visuel.
  • 03GPT-Live-1 mini remplace par défaut l'Advanced Voice Mode ; les utilisateurs payants accèdent à GPT-Live-1, conçu pour des conversations de 30 à 40 minutes.
OpenAI lance GPT-Live-1, ses nouveaux modèles vocaux full-duplex pour ChatGPT

OpenAI a présenté deux nouveaux modèles vocaux, GPT-Live-1 et GPT-Live-1 mini, conçus pour des conversations plus naturelles en temps réel. Ces modèles full-duplex permettent à l'IA de parler et d'écouter simultanément, autorisant l'utilisateur à interrompre naturellement et activant des fonctionnalités comme la traduction en direct.

L'architecture précédente d'OpenAI combinait trois étapes distinctes : transcription vocale, génération de réponse par un grand modèle de langage, puis synthèse vocale. Les nouveaux modèles unifient ce processus et résolvent deux problèmes majeurs : l'interruption involontaire de l'utilisateur et une capacité de raisonnement insuffisante. GPT-Live-1 peut désormais router les requêtes vers des modèles textuels plus puissants comme GPT-5.5 pour la recherche, le raisonnement ou les capacités agentiques, tout en maintenant la conversation. Le modèle peut également rester silencieux longtemps, absorbant le contexte jusqu'à être sollicité.

OpenAI remplace par défaut l'Advanced Voice Mode actuel de ChatGPT par GPT-Live-1 mini pour tous les utilisateurs. Les abonnés aux tiers payants accèdent au modèle plus large, GPT-Live-1. Selon Atty Eleti, responsable produit de ChatGPT Voice, le modèle est conçu pour des conversations longues, avec des tests internes montrant des échanges de 30 à 40 minutes. Le modèle peut aussi présenter les informations en format visuel, complétant les réponses vocales.

OpenAI souligne que plus de 150 millions de personnes utilisent déjà ChatGPT via des fonctionnalités vocales. La direction envisage la voix comme interface primaire pour les tâches informatiques complexes et les travaux agentiques de longue durée, comparable aux usages actuels de Codex et ChatGPT.

Réagir :
Partager —XLinkedIn