Anthropic 周二公布了对 GLM-5.3 的测试,这是中国智谱开放权重的模型。它在 410 次尝试里有 50 次写出了端到端的攻击代码,接近 Anthropic 自己不对外开放的研究模型。简单的欺骗式提问有 64% 能绕过它的防护,Anthropic 希望各国政府去测这类模型。
✓ 已核实 · 3个来源