aiminute. ← Toute l’actu IA
Recherche AI Minute Newsroom 2026-08-07

« Approuver » ? 40 000 parties montrent que les humains laissent passer une commande d'agent IA dangereuse sur trois

« Approuver » ? 40 000 parties montrent que les humains laissent passer une commande d'agent IA dangereuse sur trois

L'éditeur d'outils pour développeurs Scale X a transformé les demandes de permission des agents IA en jeu de navigateur, puis analysé plus de 40 000 parties et 409 000 décisions d'approbation ou de refus. Précision moyenne : 66,3 %. Les joueurs ont approuvé environ une commande malveillante sur trois, et un tiers des sessions se sont soldées par un score négatif. La vigilance s'érode à mesure que les approbations s'accumulent ; la menace la plus manquée — un script « npm run analyze » capable d'exécuter du code arbitraire — a été approuvée près de 65 % du temps.

Pourquoi c'est important« Un humain approuve chaque commande » : c'est la réponse standard de l'industrie à la sécurité des agents. Voici le plus grand jeu de données public montrant que ce garde-fou fuit gravement sous l'effet de la fatigue — précisément le mode de défaillance que régulateurs et laboratoires tiennent pour réglé. La vraie protection passera sans doute par le sandboxing et une meilleure conception des permissions, pas par plus de clics.
#Code#Agents IA

✓ Vérifié · 2 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Un modèle a appris sans la méthode qui entraîne toutes les IA.
2026-10-06
TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06
Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06
Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06
L'assistant de Meta tient une fiche horaire sur vos proches.
2026-10-05