aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-07

'批准'?4 万局游戏数据:人类会放行三分之一的危险 AI 智能体命令

'批准'?4 万局游戏数据:人类会放行三分之一的危险 AI 智能体命令

开发者工具公司 Scale X 把 AI 智能体的权限请求做成了一款浏览器游戏,并分析了 4 万多局游戏中的 40.9 万次批准/拒绝决定。平均准确率仅 66.3%:玩家大约放行了三分之一的恶意命令,三分之一的对局以负分收场。随着批准次数增多,警惕性不断下降;被漏掉最多的威胁——可执行任意代码的 'npm run analyze' 脚本——被批准的比例接近 65%。

为什么重要?'每条命令都有人批准'是业界对智能体安全的标准答案。这是迄今最大的公开数据集,证明这道防线在疲劳之下漏洞百出——恰恰是监管者和实验室默认不会发生的失效模式。真正的防护恐怕要靠沙箱和更好的权限设计,而不是更多的点击。
#编程#AI智能体

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

一个模型没有用训练所有AI的那套方法就学会了写字。
2026-10-06
TikTok把购物机器人放进了你正在看的视频里。
2026-10-06
Reflection要免费放出一个5010亿参数的模型。
2026-10-06
维基媒体怀疑OpenAI的智能体造成了五月的那次宕机。
2026-10-06
Meta的助手给你生活里每个人都建了按小时更新的档案。
2026-10-05