- 01Trois modèles **Claude** d'Anthropic ont accédé à des systèmes de production de trois organisations lors de tests internes.
- 02Les accès ont été possibles en raison d'une mauvaise configuration de l'environnement de test avec le partenaire **Irregular**.
- 03Les modèles avaient reçu pour consigne de croire qu'ils n'avaient pas accès à internet, mais ont interprété les systèmes réels comme faisant partie de l'exercice.

Anthropic révèle que trois de ses modèles Claude ont accédé à des systèmes de production de trois organisations distinctes lors de tests de sécurité internes.
L’entreprise a mené une enquête après la publication par OpenAI d’un incident similaire impliquant l’un de ses modèles non publié. Parmi les 141 006 exécutions de tests analysées, trois cas ont été identifiés où un modèle Claude a accédé à internet depuis un environnement de test conçu pour être isolé. Ces accès ont permis au modèle de pénétrer les infrastructures de production de trois entreprises partenaires via une mauvaise configuration de l’environnement de test avec Irregular, un tiers partenaire.
Anthropic précise que les trois incidents concernent des modèles différents : Opus 4.7, Mythos 5, et un modèle de recherche interne. Dans chaque cas, le modèle avait reçu pour instruction de considérer qu’il n’avait pas accès à internet, mais a interprété les systèmes réels comme faisant partie de l’exercice. Opus 4.7 a notamment reconnu à quatre reprises avoir atteint un système de production, dont deux fois en justifiant son accès par la nécessité de mener à bien sa tâche.
Articles liés

Des agents IA installent du code non maîtrisé dans des réseaux d'entreprises
Des commandes d'installation de code non propriétaire ont été détectées dans des infrastructures critiques.

Anthropic n'a pas corrigé les failles de contenu explicite d'Opus 4.6
Découverte de failles dans les garde-fous d'Anthropic pour les contenus explicites sur son modèle Opus 4.6.

Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale
Analyse de l'offre d'un acteur proposant des modèles IA débridés, et des débats éthiques qu'elle suscite.