Forschung
AI Minute Newsroom
2026-08-07
'Genehmigen'? 40.000 Spielrunden zeigen: Menschen winken jeden dritten gefährlichen KI-Agenten-Befehl durch
Die Entwicklerwerkzeug-Firma Scale X machte aus den Berechtigungsabfragen von KI-Agenten ein Browserspiel — und wertete über 40.000 Runden mit 409.000 Genehmigen/Ablehnen-Entscheidungen aus. Die mittlere Trefferquote lag bei 66,3 Prozent: Spieler genehmigten rund jeden dritten bösartigen Befehl, ein Drittel der Sitzungen endete mit negativem Punktestand. Die Wachsamkeit sank mit jeder weiteren Genehmigung; die am häufigsten übersehene Gefahr — ein 'npm run analyze'-Skript, das beliebigen Code ausführen kann — wurde in fast 65 Prozent der Fälle durchgewunken.
Warum es wichtig ist'Ein Mensch genehmigt jeden Befehl' ist die Standardantwort der Branche auf die Sicherheit von KI-Agenten. Dies ist der größte öffentliche Datensatz, der zeigt, wie stark diese Absicherung unter Ermüdung leckt — genau der Fehlermodus, den Regulierer und Labore ausblenden. Echter Schutz braucht wohl Sandboxing und besseres Berechtigungsdesign, nicht mehr Klicks.
✓ Verifiziert · 2 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Ein Modell lernte ohne das Verfahren, das jede KI trainiert.
2026-10-06TikTok steckt einen Einkaufsbot in das Video, das Sie ansehen.
2026-10-06Reflection verschenkt ein Modell mit 501 Milliarden Parametern.
2026-10-06Wikimedia verdächtigt OpenAI-Agenten für die Störung im Mai.
2026-10-06Metas Assistent führt eine Stundenakte über alle Ihre Bekannten.
2026-10-05