watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

Un prêt de 400 M$ garanti par des puces d'inférence IA pour un cloud dédié

vendredi 17 juillet 202612:001 min de lecture1 source citée
L'essentiel — 3 points
  • 01General Compute obtient un prêt de 400 M$ garanti par des puces d'inférence IA, une première.
  • 02Les puces SN50 de SambaNova, optimisées pour l'inférence, promettent une efficacité énergétique et une rapidité supérieure aux GPU.
  • 03Upper90, déjà actif dans le financement de GPU, mise désormais sur l'inférence pour accompagner la demande en modèles open source.
Un prêt de 400 M$ garanti par des puces d'inférence IA pour un cloud dédié

General Compute, une startup spécialisée dans le cloud d'inférence IA, a obtenu un prêt de 400 millions de dollars auprès de Upper90, un fonds d'investissement technologique. Ce financement marque une première : les puces utilisées comme garantie sont conçues spécifiquement pour l'inférence, et non pour l'entraînement des modèles d'IA.

L'entreprise, fondée par Finn Puklowski, s'appuie sur des puces SN50 développées par SambaNova, un fabricant de semi-conducteurs soutenu par Intel. Ces puces, optimisées pour l'inférence, se distinguent par leur efficacité énergétique et l'absence de besoin en systèmes de refroidissement par eau, contrairement aux GPU traditionnels. General Compute revendique une vitesse d'inférence 16 fois supérieure à celle des clouds basés sur GPU.

Upper90, dirigé par Billy Libby, ancien trader quantitatif chez Goldman Sachs, a déjà financé des achats de GPU via Crusoe en 2021. Cette approche, alors inédite, s'est généralisée avec des prêts garantis par des puces avancées. Upper90 justifie ce virage vers l'inférence par la maturité du marché des GPU et l'importance croissante des modèles open source, jugés plus accessibles que les solutions des laboratoires de pointe.

Réagir :
Partager —XLinkedIn
Sources citées