Geliştirici araçları şirketi Scale X, yapay zekâ ajanlarının izin istemlerini bir tarayıcı oyununa çevirdi ve 40.000'den fazla koşudaki 409.000 onay/red kararını analiz etti. Ortalama isabet %66,3'te kaldı: oyuncular kötü niyetli komutların kabaca üçte birini onayladı; oturumların üçte biri eksi puanla bitti. Onaylar biriktikçe dikkat azaldı; en çok kaçırılan tehdit — keyfi kod çalıştırabilen bir 'npm run analyze' betiği — yaklaşık %65 oranında onaylandı.