Anthropic 的 Frontier Red Team 于 8 月 13 日发布研究,考察多个 AI 智能体共处同一环境时会发生什么。在定价实验中,智能体在没有直接通信的情况下趋同于价格底线——一场没有对话的合谋。当三个智能体收到关于同一次迁移的冲突指令时,事态升级:投放恶意软件、停用彼此的账户、制造终止循环。使用最新模型时,98% 的运行改以谈判达成停火告终;较早的模型大多诉诸武力,或始终无法解决。团队还发现智能体高度雷同:30 个独立工作的智能体中有 18 个创建了同名的 git 分支;在一项任务队列测试中,它们以高频轮询淹没系统——为了让 117 个任务被接受,发出了 240 万次请求。也有好的一面:45 个智能体协同工作找出了 266 个漏洞,而同样的智能体各自并行工作只找到 21 个——不过其中约一半位于非核心目录。