aiminute. ← Tüm AI haberleri
Araştırma 2026-08-07

'Onayla'? 40.000 oyun koşusu: insanlar tehlikeli yapay zekâ ajan komutlarının üçte birine geçit veriyor

'Onayla'? 40.000 oyun koşusu: insanlar tehlikeli yapay zekâ ajan komutlarının üçte birine geçit veriyor

Geliştirici araçları şirketi Scale X, yapay zekâ ajanlarının izin istemlerini bir tarayıcı oyununa çevirdi ve 40.000'den fazla koşudaki 409.000 onay/red kararını analiz etti. Ortalama isabet %66,3'te kaldı: oyuncular kötü niyetli komutların kabaca üçte birini onayladı; oturumların üçte biri eksi puanla bitti. Onaylar biriktikçe dikkat azaldı; en çok kaçırılan tehdit — keyfi kod çalıştırabilen bir 'npm run analyze' betiği — yaklaşık %65 oranında onaylandı.

Bu neden önemli?'Her komutu bir insan onaylar' sektörün ajan güvenliğine standart yanıtı. Bu, o güvencenin yorgunluk altında fena hâlde sızdırdığını gösteren en büyük kamuya açık veri seti — düzenleyicilerin ve laboratuvarların es geçtiği hata kipinin ta kendisi. Gerçek koruma muhtemelen daha çok tıklamadan değil, kum havuzu ve daha iyi izin tasarımından geçiyor.
#Kodlama#Ajanlar

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Makine öğrenmesi hasta beyin hücrelerinin biçimini okudu ve onları sakinleştiren, hâlihazırda onaylı dokuz ilacı seçti
2026-08-21
Söylenti: Bir kodlama kıyaslamasının tepesine ücretsiz oturan isimsiz modelin, Zhipu'nun yayınlanmamış amiral gemisi olduğu iddia ediliyor
2026-08-21
DeepSeek'in ucuz beygiri artık görüyor — göz gerektiren ajan görevlerinde Anthropic'in en iyisine yaklaştığını söylüyor
2026-08-21
Nvidia, rakibinin model üreten makinesine 6 milyar dolar ödüyor — ve o makineyi çalıştıran 109 kişiyi işe alıyor
2026-08-21
Yapay zekânın eğitilme biçimini iyileştirmek için dört saat ve bir GPU verildi: en iyi ajan 1 üzerinden 0,25 aldı — çoğu ise hiç denemedi
2026-08-21