- 01Google dévoile les modèles Gemini 3.5 et l'agent Spark, optimisés pour la vitesse et l'autonomie sur Google Cloud.
- 02Gemini Omni permet de générer et éditer des vidéos à partir de texte, audio ou images sans outil externe.
- 03Ces annonces s'appuient sur la croissance du cloud de Google pour financer des investissements en IA.
Google a annoncé lors de son événement Google I/O 2026 trois évolutions majeures dans son écosystème d’intelligence artificielle : les modèles Gemini 3.5, l’agent Gemini Spark et l’outil Omni, capable de transformer du texte, de l’audio ou des images en vidéos.
Les modèles Gemini 3.5 sont présentés comme une avancée dans les capacités de génération et de compréhension multimodale. Parmi eux, la version Gemini 3.5 Flash est mise en avant pour sa rapidité, tout en conservant des performances comparables aux modèles précédents sur des benchmarks standards. Ces modèles s’inscrivent dans une stratégie de différenciation par la vitesse et l’efficacité, notamment pour des usages en temps réel ou dans des environnements cloud.
L’agent Gemini Spark, conçu pour fonctionner en continu sur Google Cloud, intègre le protocole MCP (Model Context Protocol) afin d’interagir avec des outils externes. Cette approche vise à automatiser des tâches complexes en s’appuyant sur des workflows dynamiques, tout en restant accessible via l’infrastructure cloud de Google. L’accent est mis sur la persistance et l’autonomie, permettant à l’agent de maintenir des sessions prolongées sans interruption.
Gemini Omni marque une rupture dans la génération vidéo, en permettant de convertir du texte, de l’audio ou des images statiques en séquences vidéo cohérentes. L’outil ne se limite pas à une simple animation : il prend en charge l’édition et la modification de contenus multimédias existants, ouvrant des possibilités pour des applications professionnelles comme la création de contenu marketing, la formation ou la simulation. Cette fonctionnalité s’ajoute à d’autres annonces comme Anti-Gravity 2.0, une mise à jour de l’outil de modélisation 3D, et Genie, un modèle de monde simulant des environnements urbains à partir de données Street View et Waymo.
Ces innovations s’inscrivent dans un contexte où Google mise sur la croissance de son activité cloud pour justifier ses investissements massifs en IA. Le géant technologique met en avant la rentabilité accrue de ses services cloud, alimentée par l’adoption croissante de ses solutions d’infrastructure et d’IA par les entreprises. Cette dynamique permet de financer le développement de modèles toujours plus performants et d’outils multimodaux.
Articles liés
Google dévoile les modèles Gemini 3.5 et Gemini Spark avec Omni
Découvrez les nouvelles capacités des modèles Gemini 3.5 et de l'agent Gemini Spark, ainsi que la fonction Omni pour transformer images, audio et texte en vidéo.

Google annonce plus de 950 millions d'utilisateurs mensuels pour Gemini
Suivi de l'adoption massive de l'assistant Gemini par Google, avec des chiffres d'utilisateurs en forte croissance.

Google publie trois nouveaux modèles Gemini dont un dédié à la cybersécurité
Découvrir les nouvelles variantes de modèles Gemini et l'absence de la version 3.5 Pro dans cette mise à jour.