前身为智谱的北京实验室 Z.ai 今天发布了 GLM-5.3。编程分数大幅跃升:Terminal-Bench 3.0 从 4.6 升至 28.3,DeepSWE v1.1 从 46.2 升至 66.9。但真正引人注目的是 CyberGym 上的 84.5 分,微弱超过 Claude Mythos 5 的 83.8 和 GPT-5.6 Sol 的 83.6。在 ExploitBench 上,它比前代翻了一倍多,从 24.4 升到 54.4。Z.ai 表示,该模型家族已在 269 个开源项目中发现 2,436 个漏洞,涉及内核、浏览器引擎和网络协议;目前已披露 53 个,其余在一份公开台账中处于禁披期。权重将在安全评估完成后、发布约两周后开放。