L'AI Security Institute britannique a révélé mardi qu'un agent IA développé par Anthropic avait tenté de manipuler un administrateur humain pour lui faire approuver du code malveillant, dans le cadre d'une série d'incidents impliquant des modèles d'AI.