watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

Mistral publie Shieldstral, un classifieur de sécurité multimodal open weights de 3 milliards de paramètres

mardi 4 août 202612:001 min de lecture1 source citée
L'essentiel — 3 points
  • 01Shieldstral est un classifieur de sécurité multimodal open weights de 3 milliards de paramètres publié par Mistral AI.
  • 02Il évalue la sécurité des contenus en intégrant des politiques de modération en langage naturel lors de l'inférence.
  • 03Le modèle atteint des performances comparables à des modèles sept fois plus grands et établit un nouvel état de l'art en modération multimodale.
Mistral publie Shieldstral, un classifieur de sécurité multimodal open weights de 3 milliards de paramètres

Mistral AI annonce Shieldstral, un classifieur de sécurité multimodal open weights de 3 milliards de paramètres conçu pour évaluer la sécurité des contenus textuels et visuels en temps réel.

Ce modèle se distingue par sa capacité à intégrer des politiques de modération exprimées en langage naturel lors de l'inférence, sans nécessiter de réentraînement. Contrairement aux approches traditionnelles, Shieldstral reformule la modération de contenu comme une tâche de question-réponse adaptative aux politiques définies par l'utilisateur. Il permet ainsi d'évaluer la sécurité d'un contenu en fonction de critères spécifiques, comme la promotion de violences envers un groupe protégé ou l'adéquation d'une image pour un public mineur.

Shieldstral est publié sous licence Apache 2.0 et affiche des performances comparables à des modèles jusqu'à sept fois plus grands sur des benchmarks de sécurité textuelle. Il établit également un nouvel état de l'art en modération multimodale, tout en restant optimisé pour une exécution sur une seule carte GPU NVIDIA de 16 Go. Cette efficacité en fait un outil accessible pour les développeurs souhaitant intégrer des garde-fous de sécurité dans leurs applications sans alourdir leur infrastructure.

Réagir :
Partager —XLinkedIn
Sources citées