aiminute. ← 全部AI新闻
行业 AI Minute Newsroom 2026-08-23

被问到自家「智能体」里有多少能无人值守完成多步任务时,十家公司里有七家答:四分之一或更少

被问到自家「智能体」里有多少能无人值守完成多步任务时,十家公司里有七家答:四分之一或更少

VentureBeat 旗下的研究部门调查了 107 家正在实际部署 AI 系统的企业——软件与机器学习工程师、产品经理、AI 与数据总监——并于 8 月 20 日发布结果。71% 的受访者表示,他们以「智能体」名义上线的东西中,只有四分之一或更少能自主完成多步工作。五分之一表示,当某个智能体开始失控烧钱时,他们无法实时叫停。多数企业并不押注单一技术栈,而是并行使用多套编排工具:85% 用两套或以上,64% 用三套。其中 70% 使用微软 Foundry 或 Copilot Studio,68% 使用 OpenAI 的 Agents SDK,47% 使用 Anthropic 的 Claude 平台。被提及最多的限制不是能力,而是安全与权限管理,占 37%。

为什么重要?107 家自愿参与的公司样本偏小,具体百分比不必较真,方向值得当真。有两点突出。被当作「智能体」卖出去的东西,与真正能无人值守运行的东西之间,差距大到多数买方按自己的说法仍在盯着几乎所有环节。而排在抱怨榜首的,不是模型不够聪明,而是没有人能准确说清这个智能体被允许扮演什么身份,也无法在它出错时可靠地拔掉插头。这正是本周 Model Context Protocol 维护者从线路另一端描述的同一个缺口。
#AI智能体

✓ 已核实 · 1个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

一个为写代码的智能体、而不是为人建的搜索索引:7000 万份 README、issue 和 PR,试用甚至不需要密钥
2026-08-23
来北京的机器人是去年的四倍——其中96%是中国的
2026-08-23
把 AI 接入各种工具的那套标准,当初是按「有个人点同意」来设计的。新版路线图承认:现在发起调用的是机器。
2026-08-23
一个270亿参数的模型在复现已发表论文上胜过了Opus 4.8和GPT-5.5
2026-08-23
阿里巴巴用一整架100部真实手机训练模型——如今在真机上100个任务能完成92个
2026-08-23