Un prêt de 400 M$ garanti par des puces d'inférence IA pour un cloud dédié
- 01General Compute obtient un prêt de 400 M$ garanti par des puces d'inférence IA, une première.
- 02Les puces SN50 de SambaNova, optimisées pour l'inférence, promettent une efficacité énergétique et une rapidité supérieure aux GPU.
- 03Upper90, déjà actif dans le financement de GPU, mise désormais sur l'inférence pour accompagner la demande en modèles open source.

General Compute, une startup spécialisée dans le cloud d'inférence IA, a obtenu un prêt de 400 millions de dollars auprès de Upper90, un fonds d'investissement technologique. Ce financement marque une première : les puces utilisées comme garantie sont conçues spécifiquement pour l'inférence, et non pour l'entraînement des modèles d'IA.
L'entreprise, fondée par Finn Puklowski, s'appuie sur des puces SN50 développées par SambaNova, un fabricant de semi-conducteurs soutenu par Intel. Ces puces, optimisées pour l'inférence, se distinguent par leur efficacité énergétique et l'absence de besoin en systèmes de refroidissement par eau, contrairement aux GPU traditionnels. General Compute revendique une vitesse d'inférence 16 fois supérieure à celle des clouds basés sur GPU.
Upper90, dirigé par Billy Libby, ancien trader quantitatif chez Goldman Sachs, a déjà financé des achats de GPU via Crusoe en 2021. Cette approche, alors inédite, s'est généralisée avec des prêts garantis par des puces avancées. Upper90 justifie ce virage vers l'inférence par la maturité du marché des GPU et l'importance croissante des modèles open source, jugés plus accessibles que les solutions des laboratoires de pointe.
Articles liés

Kog optimise l'inférence des modèles IA sur GPU avec un moteur logiciel
Une startup française développe une approche pour améliorer l'efficacité des GPU dans les workflows agentiques.

Nvidia garantit la valeur de ses GPU vieillissants via un plan financier de 500 milliards de dollars
Décryptage de la stratégie financière de Nvidia pour maintenir la valeur de ses GPU face à l'obsolescence technologique.

Nvidia étend son avantage IA avec des systèmes d'orchestration pour centres de données
Analyse des innovations techniques pour optimiser l'efficacité des centres de données.