- 01Google lance les modèles Gemini 3.5 et l'agent Gemini Spark, avec support des outils MCP sur Google Cloud.
- 02La fonction Omni permet de générer des vidéos à partir d'images, d'audio ou de texte.
- 03D'autres outils comme Anti-Gravity 2.0 et Genie (simulation urbaine) sont également mis à jour.
Google annonce les modèles Gemini 3.5 et Gemini Spark, ainsi que la fonction Omni, qui permet de transformer images, audio et texte en vidéo. Ces annonces, faites lors de Google I/O, introduisent des outils multimodaux avancés et un agent toujours actif intégré à Google Cloud.
Les modèles Gemini 3.5 et Gemini 3.5 Flash sont présentés comme des versions optimisées pour la vitesse et les benchmarks, avec une emphase sur les performances en temps réel. Gemini Spark, un agent toujours actif, fonctionne sur Google Cloud et prend en charge les outils MCP (Model Context Protocol), permettant une intégration plus poussée avec d'autres services et applications. Ces outils s'inscrivent dans une stratégie de Google pour renforcer ses capacités multimodales et automatiser des tâches complexes.
La fonction Omni marque une avancée significative en matière de génération et d'édition vidéo. Elle permet de convertir des images, des fichiers audio et du texte en vidéos, offrant ainsi une nouvelle dimension pour la création de contenu multimédia. Cette capacité s'ajoute à d'autres mises à jour comme Anti-Gravity 2.0, une version améliorée d'un outil de modélisation 3D, et Gemini for Science, conçu pour optimiser les flux de travail de recherche scientifique. Par ailleurs, Genie, un modèle de monde simulant des environnements urbains, peut désormais s'appuyer sur des données Street View et Waymo pour des simulations plus réalistes.
Ces annonces reflètent une tendance croissante vers des systèmes IA plus intégrés et polyvalents, capables de gérer simultanément plusieurs types de données et de tâches. L'accent mis sur la multimodalité et l'automatisation ouvre des perspectives pour des applications professionnelles, éducatives et créatives, tout en soulevant des questions sur l'accessibilité et la maîtrise de ces outils par les utilisateurs finaux.
Articles liés
Google lance les modèles Gemini 3.5 et l'agent Spark, et dévoile Omni pour générer des vidéos
Découvrez les dernières innovations de Google en IA générative, des modèles avancés aux outils multimodaux pour les entreprises.

Google lance les modèles Gemini 3.5 et l'agent Omni pour la génération vidéo
Google annonce les avancées de ses modèles Gemini 3.5 et de l'agent Omni, capable de convertir du texte, des images et de l'audio en vidéos.

Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep
Les utilisateurs peuvent désormais dicter des actions dans leurs applications Google via une IA conversationnelle.