Google publie Gemini Robotics 2.0 avec un modèle accessible aux développeurs
- 01Gemini Robotics 2.0 propose trois sous-modèles, dont un seul est accessible aux développeurs dès maintenant.
- 02Le modèle ER 2 améliore la détection des moments clés et la complétude des images dans les flux vidéo des robots.
- 03Les robots peuvent réessayer une étape en cas d’échec, réduisant les erreurs dans les tâches multi-étapes.

Google annonce Gemini Robotics 2.0, une mise à jour de ses modèles d’IA dédiés à la robotique, intégrant trois sous-modèles dont un seul est déjà disponible en accès public pour les développeurs.
Cette version améliore la dextérité et la sécurité des robots contrôlés par l’IA, notamment pour les machines dotées de mains humanoïdes complexes. Les robots équipés de Gemini Robotics 2.0 peuvent désormais accomplir des tâches multi-étapes en analysant en continu leur environnement et en collaborant avec d’autres robots. L’objectif reste la création d’un robot généraliste, capable d’exécuter des actions variées sans programmation spécifique pour chaque tâche.
Le modèle Gemini Robotics ER 2 (Embodied Reasoning) constitue le cœur de cette mise à jour. Il s’agit d’un modèle de vision par langage (VLM) capable de traiter des flux vidéo en temps réel depuis les caméras des robots. Cette capacité permet au système de suivre l’avancement des tâches et de détecter les échecs en temps réel. Selon Google, ER 2 identifie les moments clés d’une séquence avec une précision d’environ 90 %, contre un taux bien inférieur pour les versions précédentes ou les modèles concurrents. Il classe également la complétude des images avec une précision proche de 60 %, une amélioration significative par rapport à la version 1.6.
Le système permet aux robots de réessayer une étape spécifique en cas d’échec, sans repartir de zéro. Cette fonctionnalité réduit les erreurs dans les tâches complexes, comme verser un liquide ou manipuler des objets fragiles. Google souligne que ces avancées s’appuient sur l’intégration avec l’API Gemini Live, offrant aux développeurs un aperçu des améliorations apportées par ER 2.
Articles liés

Google DeepMind présente Gemini Robotics 2 pour les robots autonomes
Découvrez la nouvelle version de l'IA robotique de Google DeepMind, conçue pour les robots autonomes.

Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep
Les utilisateurs peuvent désormais dicter des actions dans leurs applications Google via une IA conversationnelle.

Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure
Découverte des avancées de Google en prévision météo grâce à une résolution cinq fois supérieure à son précédent modèle.