- 01Anthropic a créé le Jacobian lens, un outil d'analyse qui révèle le fonctionnement interne des modèles de langage comme Claude.
- 02La technique expose un « espace caché » où les modèles traitent les concepts, avec des découvertes variant du banal à l'inquiétant.
- 03Cette avancée contribue aux efforts d'Anthropic pour améliorer la compréhension et l'interprétabilité des grands modèles de langage.

Anthropic a mis au point une technique appelée Jacobian lens qui offre une visibilité inédite sur le fonctionnement interne des grands modèles de langage, y compris Claude. Cet outil permet aux chercheurs de l'entreprise d'observer comment ces modèles traitent les concepts et répondent aux questions.
Le Jacobian lens fonctionne en analysant ce qu'Anthropic décrit comme un « espace caché » au sein des modèles de langage. Les découvertes issues de cette technique révèlent des phénomènes allant du banal à l'inquiétant, selon les chercheurs. Cette approche représente une avancée dans la compréhension de la mécanique interne des LLM, un domaine où la transparence reste limitée.
Cette technique s'inscrit dans les efforts plus larges d'Anthropic pour améliorer l'interprétabilité des modèles d'IA. En exposant les processus internes de Claude et d'autres modèles, l'entreprise cherche à mieux comprendre comment ces systèmes fonctionnent réellement, au-delà de leurs performances observables en surface.
Articles liés

Anthropic unifie la mémoire de Chat et Cowork pour Claude
Les utilisateurs de Claude bénéficient désormais d'une continuité de contexte entre les chats et l'outil Cowork, évitant de répéter les informations.

Anthropic dépasse 65 milliards de dollars de revenus annuels en 2026
Comprendre l'essor économique d'Anthropic et ses implications pour le marché de l'IA.

Anthropic intègre SynthID-Text de Google DeepMind pour marquer les textes générés par Claude
Décryptage des mécanismes concrets d'Anthropic pour répondre aux exigences européennes de transparence sur les contenus générés par IA.