智谱于 8 月 14 日发布 GLM-5.3。真正不寻常的是它「不是」什么:基座模型与 GLM-5.2 完全相同——同样约 7440 亿参数的混合专家架构,每个 token 激活约 400 亿参数。所有宣称的提升都来自后训练:更长的训练时长、比上一代多出数十倍的长上下文任务环境,以及更丰富的环境类型。智谱称其编程能力较 GLM-5.2 提升约 50%,在 Terminal Bench 3.0 与 Agents' Last Exam 上位居开源权重模型第一,CyberGym 安全基准得分 84.5%。在该公司自家的 Code Bench 上,GLM-5.3 为 31.4%,高于 Claude Opus 4.8 的 29.5%,且平均输出约 5 万 token,而 Opus 约为 12 万。这些数字大多出自智谱自己的评测。权重尚未公开:公司称将在安全加固完成后、发布约两周后放出。