aiminute. ← सभी AI समाचार
अनुसंधान 2026-08-07

'अप्रूव'? 40,000 गेम रन बताते हैं — इंसान हर तीन में से एक खतरनाक AI एजेंट कमांड पास कर देते हैं

'अप्रूव'? 40,000 गेम रन बताते हैं — इंसान हर तीन में से एक खतरनाक AI एजेंट कमांड पास कर देते हैं

डेवलपर-टूल्स कंपनी Scale X ने AI एजेंट की अनुमति-प्रॉम्प्ट्स को ब्राउज़र गेम में बदला और 40,000+ रन में 4,09,000 अप्रूव/डिनाय फैसलों का विश्लेषण किया। औसत सटीकता 66.3% रही: खिलाड़ियों ने लगभग हर तीसरी दुर्भावनापूर्ण कमांड को मंजूरी दी, और एक-तिहाई सेशन नकारात्मक स्कोर पर खत्म हुए। मंजूरियाँ बढ़ने के साथ सतर्कता घटती गई; सबसे ज़्यादा चूका गया खतरा — मनमाना कोड चला सकने वाली 'npm run analyze' स्क्रिप्ट — करीब 65% बार पास कर दी गई।

यह क्यों मायने रखता है'हर कमांड को इंसान मंजूरी देता है' — एजेंट सुरक्षा पर उद्योग का मानक जवाब यही है। यह अब तक का सबसे बड़ा सार्वजनिक डेटासेट है जो दिखाता है कि थकान में यह ढाल बुरी तरह चूकती है — ठीक वही विफलता जिसे नियामक और लैब्स नज़रअंदाज़ करते हैं। असली सुरक्षा शायद ज़्यादा क्लिक से नहीं, सैंडबॉक्सिंग और बेहतर अनुमति-डिज़ाइन से आएगी।
#कोडिंग#AI एजेंट

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

मशीन लर्निंग ने बीमार मस्तिष्क कोशिकाओं का आकार पढ़ा और नौ पहले से स्वीकृत दवाएँ चुनीं जिन्होंने उन्हें शांत किया
2026-08-21
अफवाह: जिस गुमनाम मॉडल ने मुफ्त में कोडिंग बेंचमार्क में शीर्ष स्थान लिया, वह कथित तौर पर झिपू का अघोषित फ्लैगशिप है
2026-08-21
डीपसीक का सस्ता वर्कहॉर्स अब देख सकता है — और आँखों वाली एजेंट कार्यों में वह एंथ्रोपिक के सर्वश्रेष्ठ के करीब होने का दावा करता है
2026-08-21
एनवीडिया प्रतिद्वंद्वी की "मॉडल बनाने वाली मशीन" के लिए 6 अरब डॉलर दे रहा है — और उसे चलाने वाले 109 लोगों को नौकरी दे रहा है
2026-08-21
एआई को प्रशिक्षित करने का तरीका सुधारने के लिए चार घंटे और एक जीपीयू दिया गया: सर्वश्रेष्ठ एजेंट को 1 में से 0.25 मिले — और अधिकांश ने कोशिश ही नहीं की
2026-08-21