aiminute. ← 全部AI新闻
新模型 2026-08-17

智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%

智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%

智谱于 8 月 14 日发布 GLM-5.3。真正不寻常的是它「不是」什么:基座模型与 GLM-5.2 完全相同——同样约 7440 亿参数的混合专家架构,每个 token 激活约 400 亿参数。所有宣称的提升都来自后训练:更长的训练时长、比上一代多出数十倍的长上下文任务环境,以及更丰富的环境类型。智谱称其编程能力较 GLM-5.2 提升约 50%,在 Terminal Bench 3.0 与 Agents' Last Exam 上位居开源权重模型第一,CyberGym 安全基准得分 84.5%。在该公司自家的 Code Bench 上,GLM-5.3 为 31.4%,高于 Claude Opus 4.8 的 29.5%,且平均输出约 5 万 token,而 Opus 约为 12 万。这些数字大多出自智谱自己的评测。权重尚未公开:公司称将在安全加固完成后、发布约两周后放出。

为什么重要?两年来,做出更好模型的配方一直是「更大、重新训练的基座」。而这里的主张是:基座原封不动,仅靠后续训练的内容就能取得大幅跃升——这要便宜得多,也是小实验室有可能复制的路径。但在权重公开之前,请对这个跃升的幅度保持谨慎:此处几乎所有数字都由卖这个模型的公司自己生成和公布,外部尚无人验证。
#编程

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21