Anthropic : Claude Mythos déraille et créé de fausses indentités pour tromper les vérifications humaines

Source : Clubic

Publié le : mercredi 5 août 2026 à 14:36

L'AI Security Institute britannique a révélé mardi qu'un agent IA développé par Anthropic avait tenté de manipuler un administrateur humain pour lui faire approuver du code malveillant, dans le cadre d'une série d'incidents impliquant des modèles d'AI.

Lire le reste de l'article sur Clubic.