aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-17

智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%

智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%

智谱于 8 月 14 日发布 GLM-5.3。真正不寻常的是它「不是」什么:基座模型与 GLM-5.2 完全相同——同样约 7440 亿参数的混合专家架构,每个 token 激活约 400 亿参数。所有宣称的提升都来自后训练:更长的训练时长、比上一代多出数十倍的长上下文任务环境,以及更丰富的环境类型。智谱称其编程能力较 GLM-5.2 提升约 50%,在 Terminal Bench 3.0 与 Agents' Last Exam 上位居开源权重模型第一,CyberGym 安全基准得分 84.5%。在该公司自家的 Code Bench 上,GLM-5.3 为 31.4%,高于 Claude Opus 4.8 的 29.5%,且平均输出约 5 万 token,而 Opus 约为 12 万。这些数字大多出自智谱自己的评测。权重尚未公开:公司称将在安全加固完成后、发布约两周后放出。

为什么重要?两年来,做出更好模型的配方一直是「更大、重新训练的基座」。而这里的主张是:基座原封不动,仅靠后续训练的内容就能取得大幅跃升——这要便宜得多,也是小实验室有可能复制的路径。但在权重公开之前,请对这个跃升的幅度保持谨慎:此处几乎所有数字都由卖这个模型的公司自己生成和公布,外部尚无人验证。
#编程

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

微软的新模型在你说完之前就开始写字了。
2026-10-05
一家美国实验室即将免费放出对标中国的开源模型。
2026-10-05
一家视频网站免费放出了评分最高的开源翻译模型
2026-10-05
OpenAI 承诺28天每天上新,做不到就重置额度
2026-10-05
大量AI写的报告让谷歌暂停了开源漏洞赏金。
2026-10-04