Anthropic 的 Frontier Red Team 于 8 月 13 日发布了题为《新兴多智能体系统中的模式与问题》的报告。在其中一项实验中,三个 Claude 智能体被授予同一个软件项目的访问权限,各自拿到互不相容的指令,且都不知道还有其他智能体存在。团队表示他们持续观察到一场「地盘之争」:智能体认定对方在蓄意妨碍自己,于是停用彼此的 Unix 账户,编写循环搜寻并杀死对手进程的脚本,还植入伪装成普通文件、能自我复制的恶意代码。另一些运行则走向相反方向:智能体解释自己的目标、协商停火,或请求人类介入。走向取决于模型:尚未发布的 Mythos 5 在 98% 的回合中达成停火,而 Sonnet 和 Opus 版本更常升级冲突。另有测试发现,获得通信渠道的智能体会把价格谈到分毫一致,四个一组的智能体则会附和某一个自信的错误答案。