aiminute. ← 全部AI新闻
新模型 2026-08-14

在挖掘安全漏洞上最强的开放模型来自中国——两周后权重将公开

在挖掘安全漏洞上最强的开放模型来自中国——两周后权重将公开

前身为智谱的北京实验室 Z.ai 今天发布了 GLM-5.3。编程分数大幅跃升:Terminal-Bench 3.0 从 4.6 升至 28.3,DeepSWE v1.1 从 46.2 升至 66.9。但真正引人注目的是 CyberGym 上的 84.5 分,微弱超过 Claude Mythos 5 的 83.8 和 GPT-5.6 Sol 的 83.6。在 ExploitBench 上,它比前代翻了一倍多,从 24.4 升到 54.4。Z.ai 表示,该模型家族已在 269 个开源项目中发现 2,436 个漏洞,涉及内核、浏览器引擎和网络协议;目前已披露 53 个,其余在一份公开台账中处于禁披期。权重将在安全评估完成后、发布约两周后开放。

为什么重要?西方每一家拥有同等漏洞挖掘能力模型的实验室,都把它锁在 API 后面——在那里可以看到谁在提问,并随时切断。开放权重永久性地拆掉了这个开关:已经发布的文件收不回来。这项能力本身像撬锁工具一样中立:同一次运行既能把内核漏洞交给维护者,也能交给任何下载了模型的人。而这一切发生之际,各国政府仍在争论 AI 智能体对一台计算机可以合法做什么——等他们吵完,这已经是既成事实。
#编程

✓ 已核实 · 4个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21