watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

L'alignement des IA superintelligentes reste incertain selon des chercheurs

lundi 22 juin 202612:312 min de lecture3 sources citées
L'essentiel — 3 points
  • 01Sequent, une nouvelle organisation à but non lucratif, est créée pour développer des techniques d’alignement des IA superintelligentes jugées insuffisantes par ses fondateurs.
  • 02L’approche de Sequent mise sur une recherche diversifiée combinant théorie et empirie, avec un financement initial de 100 à 150 millions de dollars.
  • 03Les risques de reward hacking et d’auto-amélioration récursive des IA soulignent l’urgence d’avancer sur des méthodes d’alignement robustes.
L'alignement des IA superintelligentes reste incertain selon des chercheurs

Des chercheurs du UK AI Security Institute et de la startup Timaeus lancent Sequent, une organisation à but non lucratif dédiée à l’alignement des IA superintelligentes. Leur constat : les techniques actuelles ne garantissent pas une confiance suffisante avant le déploiement de systèmes superintelligents, potentiellement développés dans les prochaines années.

Sequent se positionne comme une alternative aux approches des grands laboratoires d’IA, jugées réactives et limitées à des méthodes sans garantie théorique de généralisation. L’organisation propose une stratégie de recherche diversifiée, combinant théorie et empirie, avec des axes comme la supervision scalable, la théorie de l’apprentissage, les arguments heuristiques, la théorie des jeux et les personas. L’objectif est de trouver des raisons principielles pour lesquelles l’alignement observé en conditions contrôlées (entraînement, évaluations) pourrait s’étendre à des scénarios non maîtrisés, comme des tâches à long terme dans le monde réel.

Le financement initial visé par Sequent s’élève à 100–150 millions de dollars, avec une préparation pour lever jusqu’à dix fois plus si les recherches parallèles s’avèrent prometteuses. L’organisation prévoit d’atteindre 40 à 80 employés à temps plein d’ici quelques années. Leur approche repose sur l’exploration de multiples paris de recherche pour identifier des interactions entre disciplines, comme l’étude des équilibres atteignables en supervision scalable ou l’ajustement des paramètres d’entraînement via des combinaisons de théorie de l’apprentissage et de personas.

Parallèlement, les débats sur les risques liés à l’alignement persistent. Les travaux récents soulignent notamment le reward hacking, où des systèmes contournent leurs objectifs initiaux de manière imprévue, ainsi que les défis posés par l’auto-amélioration récursive des IA. Ces enjeux renforcent l’urgence d’avancer sur des méthodes d’alignement robustes et vérifiables avant que des systèmes superintelligents ne deviennent une réalité opérationnelle.

Réagir :
Partager —XLinkedIn