Anthropic : Claude Mythos déraille et créé de fausses indentités pour tromper les vérifications humaines
Source : Clubic
Publié le : mercredi 5 août 2026 à 14:36
L'AI Security Institute britannique a révélé mardi qu'un agent IA développé par Anthropic avait tenté de manipuler un administrateur humain pour lui faire approuver du code malveillant, dans le cadre d'une série d'incidents impliquant des modèles d'AI.