aiminute. ← 全部AI新闻
研究 2026-08-07

'批准'?4 万局游戏数据:人类会放行三分之一的危险 AI 智能体命令

'批准'?4 万局游戏数据:人类会放行三分之一的危险 AI 智能体命令

开发者工具公司 Scale X 把 AI 智能体的权限请求做成了一款浏览器游戏,并分析了 4 万多局游戏中的 40.9 万次批准/拒绝决定。平均准确率仅 66.3%:玩家大约放行了三分之一的恶意命令,三分之一的对局以负分收场。随着批准次数增多,警惕性不断下降;被漏掉最多的威胁——可执行任意代码的 'npm run analyze' 脚本——被批准的比例接近 65%。

为什么重要?'每条命令都有人批准'是业界对智能体安全的标准答案。这是迄今最大的公开数据集,证明这道防线在疲劳之下漏洞百出——恰恰是监管者和实验室默认不会发生的失效模式。真正的防护恐怕要靠沙箱和更好的权限设计,而不是更多的点击。
#编程#AI智能体

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

机器学习读懂了患病脑细胞的形态,挑出九种已获批药物让它们平静下来
2026-08-21
传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21