Google présente Gemini 3.5 et des agents autonomes multimodaux
- 01Google a lancé Gemini 3.5, un modèle d'IA accompagné d'agents autonomes.
- 02Ces agents peuvent transformer des images, de l'audio et du texte en vidéo.
- 03La solution vise à automatiser des tâches complexes et multimodales sans intervention constante.
Google a dévoilé Gemini 3.5, un nouveau modèle accompagné d'outils agents capables de traiter et transformer images, audio et texte en vidéo. Cette annonce marque une évolution vers des systèmes d'IA plus autonomes et multimodaux.
Les agents présentés par Google intègrent des capacités de traitement multimodal, permettant de combiner différents types de données — visuelles, sonores et textuelles — pour générer du contenu vidéo. Cette approche vise à automatiser des tâches complexes sans intervention humaine constante.
Gemini 3.5 s'inscrit dans la continuité de la gamme Gemini de Google, enrichie de nouvelles fonctionnalités et d'une meilleure intégration avec les outils agents. L'objectif est de fournir aux développeurs et entreprises des solutions capables de gérer des workflows plus sophistiqués et autonomes.
Articles liés
Google lance les modèles Gemini 3.5 et l'agent Spark, et dévoile Omni pour générer des vidéos
Découvrez les dernières innovations de Google en IA générative, des modèles avancés aux outils multimodaux pour les entreprises.
Google dévoile les modèles Gemini 3.5 et Gemini Spark avec Omni
Découvrez les nouvelles capacités des modèles Gemini 3.5 et de l'agent Gemini Spark, ainsi que la fonction Omni pour transformer images, audio et texte en vidéo.

Reddit envisage de rompre son accord avec Google pour ses AI Overviews
Évaluer l'impact des partenariats IA sur la valorisation des plateformes sociales.