- 01Google lance les modèles Gemini 3.5 et l'agent Gemini Spark, avec support des outils MCP sur Google Cloud.
- 02La fonction Omni permet de générer des vidéos à partir d'images, d'audio ou de texte.
- 03D'autres outils comme Anti-Gravity 2.0 et Genie (simulation urbaine) sont également mis à jour.
Google annonce les modèles Gemini 3.5 et Gemini Spark, ainsi que la fonction Omni, qui permet de transformer images, audio et texte en vidéo. Ces annonces, faites lors de Google I/O, introduisent des outils multimodaux avancés et un agent toujours actif intégré à Google Cloud.
Les modèles Gemini 3.5 et Gemini 3.5 Flash sont présentés comme des versions optimisées pour la vitesse et les benchmarks, avec une emphase sur les performances en temps réel. Gemini Spark, un agent toujours actif, fonctionne sur Google Cloud et prend en charge les outils MCP (Model Context Protocol), permettant une intégration plus poussée avec d'autres services et applications. Ces outils s'inscrivent dans une stratégie de Google pour renforcer ses capacités multimodales et automatiser des tâches complexes.
La fonction Omni marque une avancée significative en matière de génération et d'édition vidéo. Elle permet de convertir des images, des fichiers audio et du texte en vidéos, offrant ainsi une nouvelle dimension pour la création de contenu multimédia. Cette capacité s'ajoute à d'autres mises à jour comme Anti-Gravity 2.0, une version améliorée d'un outil de modélisation 3D, et Gemini for Science, conçu pour optimiser les flux de travail de recherche scientifique. Par ailleurs, Genie, un modèle de monde simulant des environnements urbains, peut désormais s'appuyer sur des données Street View et Waymo pour des simulations plus réalistes.
Ces annonces reflètent une tendance croissante vers des systèmes IA plus intégrés et polyvalents, capables de gérer simultanément plusieurs types de données et de tâches. L'accent mis sur la multimodalité et l'automatisation ouvre des perspectives pour des applications professionnelles, éducatives et créatives, tout en soulevant des questions sur l'accessibilité et la maîtrise de ces outils par les utilisateurs finaux.
Articles liés
Google lance les modèles Gemini 3.5 et l'agent Spark, et dévoile Omni pour générer des vidéos
Découvrez les dernières innovations de Google en IA générative, des modèles avancés aux outils multimodaux pour les entreprises.

Google annonce plus de 950 millions d'utilisateurs mensuels pour Gemini
Suivi de l'adoption massive de l'assistant Gemini par Google, avec des chiffres d'utilisateurs en forte croissance.

Google publie trois nouveaux modèles Gemini dont un dédié à la cybersécurité
Découvrir les nouvelles variantes de modèles Gemini et l'absence de la version 3.5 Pro dans cette mise à jour.