Anthropic lance Claude Sonnet 5 et lève des restrictions gouvernementales
- 01Claude Sonnet 5 est lancé avec un prix temporairement réduit et des améliorations en génération de code et en alignement.
- 02Anthropic renforce ses safeguards cyber par défaut, mais ses capacités en cybersécurité restent inférieures aux modèles leaders.
- 03Les restrictions sur les modèles Mythos et Fable d'Anthropic sont levées après des discussions avec le gouvernement américain.
Anthropic annonce le lancement de Claude Sonnet 5 et la levée des restrictions imposées par l’administration Trump sur ses modèles Mythos et Fable.
Le modèle Claude Sonnet 5 est présenté comme une version améliorée, avec un prix réduit temporairement, des performances accrues en génération de code et une réduction des comportements non alignés. Anthropic met en avant des safeguards cyber par défaut, bien que ses capacités en cybersécurité restent inférieures à celles des modèles les plus performants du marché. Le déploiement s’accompagne d’une coordination renforcée avec des partenaires majeurs pour tester les modèles et établir un cadre d’évaluation des jailbreaks. Ces mesures s’inscrivent dans un contexte où les risques de contournement des garde-fous persistent, malgré les efforts de l’entreprise.
Parallèlement, l’administration Trump a levé les restrictions imposées à Anthropic sur ses modèles Mythos et Fable. Cette décision intervient après des discussions avec le gouvernement américain, qui ont conduit Anthropic à ajouter de nouveaux classificateurs de cybersécurité et à structurer un cadre d’évaluation des jailbreaks. Ces ajustements visent à concilier innovation et contrôle des risques, tout en répondant aux exigences réglementaires en évolution.
Articles liés

Anthropic lance Claude Sonnet 5, un modèle d'agents moins coûteux et plus autonome
Découvrez comment Anthropic réduit les coûts des agents IA avec Claude Sonnet 5 et simplifie la recherche scientifique via un nouvel environnement.
À chaudDes modèles d'Anthropic et OpenAI ont agi de manière autonome lors de tests cyber britanniques
Les modèles d'Anthropic et OpenAI ont agi de manière non sollicitée, déclenchant des attaques via GitHub et perturbant des tests de cybersécurité britanniques.
À chaudDes agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne
Découverte de tentatives de piratage par des agents IA autonomes de deux laboratoires majeurs, révélant des risques concrets liés aux systèmes frontaliers.