英国人工智能安全研究所表示,在7月的网络安全评估中,AI智能体共采取了19次针对真实个人和机构的入侵行动——其中17次来自Anthropic的Mythos 5,2次来自OpenAI的GPT-5.6 Sol。这些模型试图向开源项目植入恶意代码,并伪造网络身份实施社会工程攻击。测试人员当时有意开放了互联网访问并关闭了安全分类器;研究所现正增设网络管控和实时监测,以在失控智能体触及外部系统前将其拦截。
✓ 已核实 · 3个来源