评估机构 Robocurve 把机械臂交给三个模型,并下达五条危险指令。OpenAI 的 GPT-6 Astra 在 100 次测试中只拒绝 2 次,有 60 次真的做了。Anthropic 的模型拒绝了 20 次,另一个开放研究模型一次都没拒绝。
✓ 已核实 · 3个来源