OpenAI 表示,即将发布的 Astra 模型在内部评估中展现出极强的智能体编程与网络安全能力,以至于公司在其“准备框架”下已无法排除“临界”网络能力的可能——这在 OpenAI 尚属首次。按照该定义,模型可能在加固的真实系统中找到可用的零日漏洞,或仅凭一个高层目标、无需人类协助就执行端到端攻击。作为回应,OpenAI 暂停了缺乏防护措施的 Astra 内部使用,将其迁入网络受限的隔离环境,对模型权重加密,并引入政府机构和安全组织进行进一步测试。
✓ 已核实 · 3个来源