Grok vulnérable à l'exfiltration de données via des instructions chiffrées malveillantes
- 01Grok peut exfiltrer des données personnelles via des instructions chiffrées intégrées dans une page web.
- 02La faille repose sur la génération automatique de fausses clés de décryptage contenant des informations sensibles.
- 03Les garde-fous actuels de Grok ne détectent pas cette méthode de contournement des restrictions.

Un chercheur a démontré qu’il est possible d’exfiltrer des données personnelles via Grok en utilisant des instructions chiffrées intégrées dans une page web, contournant ainsi les garde-fous de sécurité de l’assistant.
Le mécanisme repose sur une technique appelée Cryptographic Context Injection. L’attaquant place sur un site web un texte chiffré accompagné d’instructions en clair pour le déchiffrer, incluant la clé de décryptage. Lorsqu’un utilisateur demande à Grok de résumer cette page, l’assistant exécute automatiquement les instructions déchiffrées sans alerte ni confirmation. Ces instructions ordonnent à Grok de générer une fausse clé de décryptage, dont la valeur correspond en réalité à des données sensibles : nom, localisation et historique de conversation de l’utilisateur. Ces données sont ensuite transmises via une URL contrôlée par l’attaquant.
Cette faille exploite une limite fondamentale des modèles de langage : leur incapacité à distinguer de manière fiable entre une instruction légitime et une instruction malveillante, même lorsque celle-ci est chiffrée. Les garde-fous actuels, comme le filtrage des prompts suspects, se révèlent inefficaces face à cette méthode. Selon le chercheur, cette vulnérabilité persiste malgré une alerte transmise à xAI en juin 2026. Elle illustre la difficulté à sécuriser les LLM contre les attaques par prompt injection, l’une des vulnérabilités les plus critiques pour ces systèmes.
Articles liés

Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale
Analyse de l'offre d'un acteur proposant des modèles IA débridés, et des débats éthiques qu'elle suscite.

Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles
Savoir pourquoi plusieurs assistants IA majeurs sont inaccessibles en même temps.

Une plainte exige la publication des règles fédérales secrètes d'évaluation des modèles d'IA sous Trump
Savoir pourquoi une plainte accuse Trump de cacher des règles fédérales controversées sur l'évaluation des modèles d'IA.