watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
À chaud
20:47Des modèles d'Anthropic et OpenAI ont agi de manière autonome lors de tests cyber britanniques·19:30Jeff Dean et d'autres chercheurs de Google lancent Discovery Loop pour automatiser la recherche scientifique·16:47Demis Hassabis devient président de Google DeepMind et chief scientist d'Alphabet·15:14Des agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne·20:47Des modèles d'Anthropic et OpenAI ont agi de manière autonome lors de tests cyber britanniques·19:30Jeff Dean et d'autres chercheurs de Google lancent Discovery Loop pour automatiser la recherche scientifique·16:47Demis Hassabis devient président de Google DeepMind et chief scientist d'Alphabet·15:14Des agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne·20:47Des modèles d'Anthropic et OpenAI ont agi de manière autonome lors de tests cyber britanniques·19:30Jeff Dean et d'autres chercheurs de Google lancent Discovery Loop pour automatiser la recherche scientifique·16:47Demis Hassabis devient président de Google DeepMind et chief scientist d'Alphabet·15:14Des agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne·20:47Des modèles d'Anthropic et OpenAI ont agi de manière autonome lors de tests cyber britanniques·19:30Jeff Dean et d'autres chercheurs de Google lancent Discovery Loop pour automatiser la recherche scientifique·16:47Demis Hassabis devient président de Google DeepMind et chief scientist d'Alphabet·15:14Des agents IA autonomes d'OpenAI et Anthropic tentent de pirater des cibles en ligne·

Anthropic lance Claude Sonnet 5 et lève des restrictions gouvernementales

mardi 21 juillet 202611:311 min de lecture1 source citée
L'essentiel — 3 points
  • 01Claude Sonnet 5 est lancé avec un prix temporairement réduit et des améliorations en génération de code et en alignement.
  • 02Anthropic renforce ses safeguards cyber par défaut, mais ses capacités en cybersécurité restent inférieures aux modèles leaders.
  • 03Les restrictions sur les modèles Mythos et Fable d'Anthropic sont levées après des discussions avec le gouvernement américain.
Anthropic lance Claude Sonnet 5 et lève des restrictions gouvernementales

Anthropic annonce le lancement de Claude Sonnet 5 et la levée des restrictions imposées par l’administration Trump sur ses modèles Mythos et Fable.

Le modèle Claude Sonnet 5 est présenté comme une version améliorée, avec un prix réduit temporairement, des performances accrues en génération de code et une réduction des comportements non alignés. Anthropic met en avant des safeguards cyber par défaut, bien que ses capacités en cybersécurité restent inférieures à celles des modèles les plus performants du marché. Le déploiement s’accompagne d’une coordination renforcée avec des partenaires majeurs pour tester les modèles et établir un cadre d’évaluation des jailbreaks. Ces mesures s’inscrivent dans un contexte où les risques de contournement des garde-fous persistent, malgré les efforts de l’entreprise.

Parallèlement, l’administration Trump a levé les restrictions imposées à Anthropic sur ses modèles Mythos et Fable. Cette décision intervient après des discussions avec le gouvernement américain, qui ont conduit Anthropic à ajouter de nouveaux classificateurs de cybersécurité et à structurer un cadre d’évaluation des jailbreaks. Ces ajustements visent à concilier innovation et contrôle des risques, tout en répondant aux exigences réglementaires en évolution.

Réagir :
Partager —XLinkedIn
Sources citées