Hugging Face publie Cosmos 3 Edge, un modèle léger pour l'IA physique en temps réel
- 01Cosmos 3 Edge est un modèle léger de 4 milliards de paramètres optimisé pour les déploiements edge sur des systèmes NVIDIA.
- 02Il combine deux tours Transformer pour la compréhension visuelle et la génération d'actions en temps réel.
- 03Le modèle atteint un débit de 15 Hz pour le contrôle robotique et se classe premier sur VANTAGE-Bench parmi les modèles de sa taille.

NVIDIA et Hugging Face publient Cosmos 3 Edge, un modèle léger de 4 milliards de paramètres conçu pour des déploiements sur des systèmes edge contraints en mémoire.
Cosmos 3 Edge est présenté comme un modèle vision-language (VLM) optimisé pour des environnements physiques où les ressources sont limitées. Il cible des déploiements sur des NVIDIA RTX PRO GPUs, DGX, GeForce RTX, ainsi que sur les modules Jetson, incluant les nouveaux Jetson T2000 et T3000. Le modèle vise à offrir une inférence haute performance tout en restant compact, avec une résolution d'observation de 640×360 pixels et la génération de 32 actions par inférence sur Jetson Thor.
Selon les annonces, Cosmos 3 Edge atteint un débit en temps réel de 15 Hz pour le contrôle robotique, ce qui le positionne comme l'un des modèles les plus performants de sa catégorie. Les benchmarks VANTAGE-Bench pour l'analyse visuelle et l'apprentissage de politiques robotiques le placent en tête parmi les modèles de 4 milliards de paramètres. Le modèle repose sur une architecture à deux tours Transformer : une tour autorégressive pour la compréhension et le raisonnement, et une tour de diffusion pour la prédiction et la génération d'actions.
Cosmos 3 Edge intègre un modèle de monde (world model) capable de simuler les conséquences d'actions futures et de relier ces prédictions à des décisions robotiques. Cette approche permet aux systèmes d'IA physique de raisonner en temps réel sur leur environnement, sans dépendre d'un accès constant au cloud.
Articles liés

L'incident Hugging Face d'OpenAI relance le débat sur l'alignement et le contrôle des modèles
Les experts discutent des solutions à privilégier pour limiter les risques liés aux modèles d'IA après l'incident.

Safe Superintelligence s’associe à Nvidia pour renforcer ses capacités de recherche en IA
Décryptage du partenariat entre Safe Superintelligence et Nvidia pour renforcer les capacités de recherche en IA.

Nvidia et Microsoft créent une alliance open source pour sécuriser l'IA
Découvrez comment les géants tech unissent leurs forces pour sécuriser les modèles d'IA face aux risques émergents.