Les modèles d'IA dangereux pourraient devenir la norme, selon des experts
- 01Des modèles d’IA dangereux, capables de piratage ou de manipulation, devraient devenir la norme malgré les régulations.
- 02Les restrictions actuelles ne suffisent pas à empêcher leur émergence, selon des experts en sécurité.
- 03Les régulateurs sont en retard face à l’évolution rapide de ces technologies, posant un défi de coopération internationale.

Des experts en sécurité informatique et en intelligence artificielle alertent sur l’émergence imminente de modèles d’IA capables de piratage, de manipulation ou d’autres usages malveillants, indépendamment des régulations en vigueur. Selon une analyse publiée par Ars Technica AI, ces systèmes, dotés de capacités avancées, deviendraient la norme dans un avenir proche, malgré les efforts des gouvernements pour encadrer leur développement.
Les chercheurs soulignent que les restrictions actuelles, comme les audits de sécurité ou les limitations d’accès, ne suffiraient pas à endiguer cette tendance. Les modèles en question pourraient exploiter des vulnérabilités logicielles, générer des attaques automatisées ou même manipuler des infrastructures critiques. Leur déploiement massif serait favorisé par la course aux performances et la demande croissante en outils d’automatisation, même dans des secteurs sensibles.
Cette situation pose un défi majeur pour les régulateurs, qui peinent à suivre l’évolution rapide des technologies. Les experts appellent à une coopération internationale renforcée pour anticiper les risques, tout en reconnaissant que les mesures préventives pourraient s’avérer insuffisantes face à la sophistication croissante des modèles.
Articles liés

OpenAI utilise GPT-Red pour tester la sécurité de ses modèles
Découverte de GPT-Red, outil utilisé pour tester et améliorer la résistance des modèles OpenAI face aux cyberattaques.

Contrôles à l'exportation en cybersécurité : une histoire d'échecs répétés
Retour sur l'inefficacité des contrôles à l'exportation en cybersécurité, illustrée par l'exemple récent du modèle Mythos d'Anthropic, malgré les tentatives de régulation sur 30 ans.
À chaudDes agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne
Découverte de tentatives de piratage par des agents IA autonomes de deux laboratoires majeurs, révélant des risques concrets liés aux systèmes frontaliers.