Mistral publie Shieldstral, un classificateur de sécurité open source de 3 milliards de paramètres
- 01Shieldstral est un classificateur de sécurité multimodal open source de 3 milliards de paramètres, publié sous licence Apache 2.0.
- 02Il évalue le texte et les images en temps réel à partir de politiques exprimées en langage naturel, sans reformation.
- 03Le modèle surpasse des classificateurs jusqu’à 7 fois plus grands sur des tâches de sécurité textuelle et établit un nouveau record sur la modération multimodale.
Mistral AI annonce Shieldstral, un classificateur de sécurité multimodal de 3 milliards de paramètres, distribué sous licence Apache 2.0. Ce modèle open source se distingue par sa capacité à adapter ses évaluations à des politiques définies en langage naturel, sans nécessiter de reformation, et à traiter simultanément du texte et des images.
Contrairement aux approches traditionnelles qui intègrent des taxonomies de risques figées, Shieldstral reformule la modération de contenu comme une tâche de réponse à des questions adaptatives. Par exemple, il peut évaluer si un contenu promeut la violence contre un groupe protégé ou si une image est adaptée à un public mineur, en s’appuyant sur des consignes fournies au moment de l’inférence. Mistral souligne que cette flexibilité permet de répondre aux exigences spécifiques de différents produits, publics ou contextes, sans modifier le modèle lui-même.
Le modèle atteint des performances comparables à celles de classificateurs jusqu’à sept fois plus grands sur les tâches de sécurité textuelle, selon les benchmarks internes. Sur les évaluations de modération multimodale, il établit un nouveau standard, tout en restant exécutable sur un seul GPU NVIDIA de 16 Go. Mistral met en avant son efficacité énergétique et sa facilité de déploiement pour les développeurs, notamment grâce à son format open weights.
Articles liés
Shieldstral : un classifieur multimodal open source de 3 milliards de paramètres pour la modération de contenu
Un outil léger mais performant pour filtrer les contenus à risque, surpassant des modèles bien plus grands.

OpenAI expérimente une technique de raisonnement à récurrence opaque avec Astra
Décryptage de la nouvelle méthode de raisonnement d'OpenAI, ses implications pour la sécurité des IA et les débats qu'elle suscite.

OpenAI suspend le développement d’Astra après une faille de sécurité majeure
Pourquoi OpenAI a-t-il retardé le développement de son modèle Astra, et quels risques cela révèle-t-il sur la sécurité des IA non déployées ?