Google présente Gemini 3.5 et des agents autonomes multimodaux
- 01Google a lancé Gemini 3.5, un modèle d'IA accompagné d'agents autonomes.
- 02Ces agents peuvent transformer des images, de l'audio et du texte en vidéo.
- 03La solution vise à automatiser des tâches complexes et multimodales sans intervention constante.
Google a dévoilé Gemini 3.5, un nouveau modèle accompagné d'outils agents capables de traiter et transformer images, audio et texte en vidéo. Cette annonce marque une évolution vers des systèmes d'IA plus autonomes et multimodaux.
Les agents présentés par Google intègrent des capacités de traitement multimodal, permettant de combiner différents types de données — visuelles, sonores et textuelles — pour générer du contenu vidéo. Cette approche vise à automatiser des tâches complexes sans intervention humaine constante.
Gemini 3.5 s'inscrit dans la continuité de la gamme Gemini de Google, enrichie de nouvelles fonctionnalités et d'une meilleure intégration avec les outils agents. L'objectif est de fournir aux développeurs et entreprises des solutions capables de gérer des workflows plus sophistiqués et autonomes.
Articles liés
Google lance les modèles Gemini 3.5 et l'agent Spark, et dévoile Omni pour générer des vidéos
Découvrez les dernières innovations de Google en IA générative, des modèles avancés aux outils multimodaux pour les entreprises.

Google lance les modèles Gemini 3.5 et l'agent Omni pour la génération vidéo
Google annonce les avancées de ses modèles Gemini 3.5 et de l'agent Omni, capable de convertir du texte, des images et de l'audio en vidéos.
Google dévoile les modèles Gemini 3.5 et Gemini Spark avec Omni
Découvrez les nouvelles capacités des modèles Gemini 3.5 et de l'agent Gemini Spark, ainsi que la fonction Omni pour transformer images, audio et texte en vidéo.