watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

Anthropic et OpenAI conçoivent leurs propres puces pour réduire la dépendance à Nvidia

jeudi 6 août 202620:032 min de lecture1 source citée
L'essentiel — 3 points
  • 01Anthropic recrute une équipe dédiée à la conception de puces sur mesure pour ses modèles d'IA, avec une approche multi-puce incluant des partenaires externes.
  • 02OpenAI a développé la puce Jalapeño en partenariat avec Broadcom pour l'inférence de grands modèles de langage.
  • 03Google, Meta et Mistral explorent aussi la conception de leurs propres puces pour réduire leur dépendance à Nvidia.
Anthropic et OpenAI conçoivent leurs propres puces pour réduire la dépendance à Nvidia

Anthropic et OpenAI développent des puces dédiées pour leurs modèles d’IA afin de limiter leur dépendance aux solutions de Nvidia.

Anthropic a annoncé la création d’une équipe dédiée à la conception de puces sur mesure pour alimenter ses modèles, notamment ceux de la famille Claude. Cette initiative s’inscrit dans une stratégie de verticalisation pour sécuriser l’infrastructure technique et réduire les risques liés à la concentration du marché des semi-conducteurs. L’entreprise confirme aussi une approche multi-puce, combinant ses propres designs avec des composants externes, comme évoqué avec Samsung comme partenaire potentiel de fabrication. OpenAI, de son côté, a récemment dévoilé une puce personnalisée nommée Jalapeño, conçue pour l’inférence de grands modèles de langage dans les data centers, en collaboration avec Broadcom.

Cette tendance s’étend à d’autres acteurs majeurs : Google utilise déjà ses propres puces pour ses modèles, Meta a conçu et déployé ses propres composants, et Mistral étudierait la même voie. Les motivations sont doubles. D’abord, la dépendance critique à Nvidia expose les entreprises à des risques stratégiques dans un contexte de forte demande en puissance de calcul. Ensuite, l’intégration verticale entre matériel et modèles pourrait améliorer les performances en optimisant les interactions entre les deux. Anthropic précise que ses équipes travailleront en co-conception entre les puces et les modèles, une pratique déjà partiellement appliquée avec des partenaires externes.

Cette course à l’autonomie technologique pourrait aussi offrir un avantage concurrentiel en permettant aux modèles de mieux s’adapter à des environnements variés, comme les périphériques ou les dispositifs edge, où les contraintes matérielles diffèrent des data centers.

Réagir :
Partager —XLinkedIn
Sources citées