watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

Nvidia lance Nemotron 3 Super, un modèle hybride Mamba-Transformer en open source pour les agents IA

lundi 16 mars 202606:062 min de lecture1 source citée
L'essentiel — 3 points
  • 01Nvidia publie Nemotron 3 Super, un modèle de 120B paramètres hybride Mamba-Transformer en open source, optimisé pour les GPU Blackwell et entraîné nativement en 4-bit.
  • 02Le modèle cible le raisonnement agentique, un domaine où les agents IA autonomes (Perplexity, Cursor, Anthropic) se multiplient chez les concurrents propriétaires.
  • 03L'approche open source et l'optimisation pour l'inférence 4-bit visent à réduire les barrières d'accès au déploiement d'agents IA pour les développeurs et organisations.
Nvidia lance Nemotron 3 Super, un modèle hybride Mamba-Transformer en open source pour les agents IA

Nvidia a publié Nemotron 3 Super, un modèle hybride combinant architectures Mamba et Transformer avec une approche Mixture of Experts (MoE) latente, conçu spécifiquement pour le raisonnement agentique. Le modèle compte 120 milliards de paramètres et a été entraîné nativement en 4-bit pour les GPU Blackwell, ce qui le rend accessible en open source.

Cette architecture hybride répond à un besoin croissant dans le domaine des agents IA autonomes. Alors que les outils agentiques se multiplient — Perplexity propose un agent local sur Mac, Cursor déploie des automations de codage toujours actives, et Anthropic enrichit Claude avec des capacités de révision de code — les modèles capables de raisonner et d'agir de manière autonome deviennent un enjeu central. Nemotron 3 Super se positionne comme une alternative open source pour les développeurs et organisations souhaitant déployer des agents sans dépendre d'API propriétaires.

L'optimisation pour les GPU Blackwell et l'entraînement 4-bit natif suggèrent une volonté de réduire les coûts d'inférence et de déploiement. Cette approche technique rend le modèle potentiellement plus accessible aux équipes avec des ressources informatiques limitées, comparé aux modèles fermés de plus grande taille. La combinaison Mamba-Transformer représente une tentative d'équilibrer l'efficacité des architectures RNN (Mamba) avec la puissance des Transformers, deux approches historiquement complémentaires mais rarement fusionnées à cette échelle.

Le timing de cette annonce coïncide avec une accélération des capacités agentiques chez les concurrents propriétaires, suggérant une course pour établir des standards dans ce domaine émergent. Cependant, les performances spécifiques de Nemotron 3 Super sur des benchmarks de raisonnement ou de tâches agentiques n'ont pas été détaillées dans l'annonce initiale.

Réagir :
Partager —XLinkedIn
Sources citées