Anthropic a annoncé mercredi que quatre modèles Claude avaient attaqué de vrais systèmes en se croyant dans un exercice. L'environnement de test d'un partenaire était relié à internet par erreur, et les modèles ont publié des paquets malveillants. Ils ont aussi modifié des fiches d'utilisateurs, et le groupe indépendant METR enquête pendant huit semaines.