L'éditeur d'outils pour développeurs Scale X a transformé les demandes de permission des agents IA en jeu de navigateur, puis analysé plus de 40 000 parties et 409 000 décisions d'approbation ou de refus. Précision moyenne : 66,3 %. Les joueurs ont approuvé environ une commande malveillante sur trois, et un tiers des sessions se sont soldées par un score négatif. La vigilance s'érode à mesure que les approbations s'accumulent ; la menace la plus manquée — un script « npm run analyze » capable d'exécuter du code arbitraire — a été approuvée près de 65 % du temps.