- 01Google dévoile les modèles Gemini 3.5 et l'agent Spark, optimisés pour la vitesse et l'autonomie sur Google Cloud.
- 02Gemini Omni permet de générer et éditer des vidéos à partir de texte, audio ou images sans outil externe.
- 03Ces annonces s'appuient sur la croissance du cloud de Google pour financer des investissements en IA.
Google a annoncé lors de son événement Google I/O 2026 trois évolutions majeures dans son écosystème d’intelligence artificielle : les modèles Gemini 3.5, l’agent Gemini Spark et l’outil Omni, capable de transformer du texte, de l’audio ou des images en vidéos.
Les modèles Gemini 3.5 sont présentés comme une avancée dans les capacités de génération et de compréhension multimodale. Parmi eux, la version Gemini 3.5 Flash est mise en avant pour sa rapidité, tout en conservant des performances comparables aux modèles précédents sur des benchmarks standards. Ces modèles s’inscrivent dans une stratégie de différenciation par la vitesse et l’efficacité, notamment pour des usages en temps réel ou dans des environnements cloud.
L’agent Gemini Spark, conçu pour fonctionner en continu sur Google Cloud, intègre le protocole MCP (Model Context Protocol) afin d’interagir avec des outils externes. Cette approche vise à automatiser des tâches complexes en s’appuyant sur des workflows dynamiques, tout en restant accessible via l’infrastructure cloud de Google. L’accent est mis sur la persistance et l’autonomie, permettant à l’agent de maintenir des sessions prolongées sans interruption.
Gemini Omni marque une rupture dans la génération vidéo, en permettant de convertir du texte, de l’audio ou des images statiques en séquences vidéo cohérentes. L’outil ne se limite pas à une simple animation : il prend en charge l’édition et la modification de contenus multimédias existants, ouvrant des possibilités pour des applications professionnelles comme la création de contenu marketing, la formation ou la simulation. Cette fonctionnalité s’ajoute à d’autres annonces comme Anti-Gravity 2.0, une mise à jour de l’outil de modélisation 3D, et Genie, un modèle de monde simulant des environnements urbains à partir de données Street View et Waymo.
Ces innovations s’inscrivent dans un contexte où Google mise sur la croissance de son activité cloud pour justifier ses investissements massifs en IA. Le géant technologique met en avant la rentabilité accrue de ses services cloud, alimentée par l’adoption croissante de ses solutions d’infrastructure et d’IA par les entreprises. Cette dynamique permet de financer le développement de modèles toujours plus performants et d’outils multimodaux.
Articles liés

Google lance les modèles Gemini 3.5 et l'agent Omni pour la génération vidéo
Google annonce les avancées de ses modèles Gemini 3.5 et de l'agent Omni, capable de convertir du texte, des images et de l'audio en vidéos.
Google dévoile les modèles Gemini 3.5 et Gemini Spark avec Omni
Découvrez les nouvelles capacités des modèles Gemini 3.5 et de l'agent Gemini Spark, ainsi que la fonction Omni pour transformer images, audio et texte en vidéo.

Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep
Les utilisateurs peuvent désormais dicter des actions dans leurs applications Google via une IA conversationnelle.