aiminute. ← 全部AI新闻
工具 2026-08-10

Anthropic研究了1053名点「批准」的开发者:危险命令只拦下13.6% —— 8月14日起,方向盘交给机器

Anthropic研究了1053名点「批准」的开发者:危险命令只拦下13.6% —— 8月14日起,方向盘交给机器

自8月14日起,Pro、Max和Team方案的用户使用Claude Code时将默认进入自动模式。所谓自动模式,是指这个编程智能体不再于每次写文件、每条shell命令前请求许可,而是把每一次工具调用交给一个分类器审查,凡是不可逆、具破坏性或指向你机器之外的操作一律拦截。Anthropic同时公布了支撑该决定的数据。在一项有1053名付费测试者参与的对照研究中,人工逐条审查许可提示的用户,只识别出摆在眼前的危险命令的13.6%;自动模式则拦下了89%。在真实生产环境的会话里,人工批准的工作出现意外有害操作的比例是自动模式的两倍以上——6.3%对2.4%。原因浓缩在一个统计里:开发者会批准所看到提示中的97%,这不是审查,这是点击。伴随此次切换,Anthropic新增了针对数据外泄的硬性拒绝规则、对git推送目标是公开仓库还是私有仓库的核验、破坏性操作前的git状态检查,以及对外部内容的提示注入筛查。被拦截的操作会促使Claude另寻更稳妥的路径;接连被拦到一定次数,会话就退回逐条询问。分类器自身消耗的token在这三个方案上不再计费。企业版、API、Bedrock、Google Cloud与Microsoft Foundry暂时仍需手动开启,Anthropic表示预计一个月内也会在这些平台上默认启用。

为什么重要?值得玩味的不是又一家公司把默认值调得更自主,而是它为此给出的理由——这个理由把惯常的论证颠倒了过来。许可提示的本意是让人留在决策回路里;而Anthropic自家的遥测数据说,回路里的这个人不过是一枚橡皮图章,一台读同样命令的机器,挑出坏命令的能力约为人的六倍。这套推理远不止适用于一款产品——软件里每一个同意对话框、每一句「确定吗?」、每一条审批队列,都建立在「被问到就会去看」这个假设之上。如果你在付费方案上使用Claude Code,实际要紧的是:无论你有没有读到公告,8月14日你的默认值都会改变;与其日后才发现,不如现在就做决定——你可以固定为另一种许可模式,管理员也可以为整个团队固定。诚实的保留意见是:89%不是100%,而且失误如今是无声的。在旧的默认下,一次差错需要你亲手点过去;在新的默认下,它谁也不需要。
#编程#AI智能体

✓ 已核实 · 4个来源

▶ 相关视频: How auto mode works with Claude Code
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Apple Music 将标注哪些歌曲由机器生成——但要不要说,取决于上传者
2026-08-21
传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
Stripe 刚以75亿美元买下一个模型路由器。几天后,Ramp 自己造了一个,并且免费送到一月。
2026-08-21