aiminute. ← Tüm AI haberleri
Araştırma AI Minute Newsroom 2026-08-07

'Onayla'? 40.000 oyun koşusu: insanlar tehlikeli yapay zekâ ajan komutlarının üçte birine geçit veriyor

'Onayla'? 40.000 oyun koşusu: insanlar tehlikeli yapay zekâ ajan komutlarının üçte birine geçit veriyor

Geliştirici araçları şirketi Scale X, yapay zekâ ajanlarının izin istemlerini bir tarayıcı oyununa çevirdi ve 40.000'den fazla koşudaki 409.000 onay/red kararını analiz etti. Ortalama isabet %66,3'te kaldı: oyuncular kötü niyetli komutların kabaca üçte birini onayladı; oturumların üçte biri eksi puanla bitti. Onaylar biriktikçe dikkat azaldı; en çok kaçırılan tehdit — keyfi kod çalıştırabilen bir 'npm run analyze' betiği — yaklaşık %65 oranında onaylandı.

Bu neden önemli?'Her komutu bir insan onaylar' sektörün ajan güvenliğine standart yanıtı. Bu, o güvencenin yorgunluk altında fena hâlde sızdırdığını gösteren en büyük kamuya açık veri seti — düzenleyicilerin ve laboratuvarların es geçtiği hata kipinin ta kendisi. Gerçek koruma muhtemelen daha çok tıklamadan değil, kum havuzu ve daha iyi izin tasarımından geçiyor.
#Kodlama#Ajanlar

✓ Doğrulandı · 2 kaynak

WhatsApp X Telegram
Uygulamada oku — ücretsiz, 9 dilde

İlgili haberler

Bir model, bütün yapay zekâyı eğiten yöntem olmadan öğrendi.
2026-10-06
TikTok izlediğiniz videonun içine alışveriş botu yerleştirdi.
2026-10-06
Reflection 501 milyar parametreli modeli ücretsiz dağıtacak.
2026-10-06
Wikipedia mayıstaki kesinti için OpenAI ajanlarından şüpheleniyor.
2026-10-06
Meta'nın asistanı çevrenizdeki herkes için saatlik dosya tutuyor.
2026-10-05