aiminute. ← 全部AI新闻
新模型 2026-08-13

DeepSeek 悄悄上线旗舰正式版——参数仍是 1.6 万亿,智能体分数翻了五倍

DeepSeek 悄悄上线旗舰正式版——参数仍是 1.6 万亿,智能体分数翻了五倍

北京时间周三深夜,DeepSeek 的 API 文档悄然从 V4-Pro 预览版切换到名为 DeepSeek-V4-Pro-0813 的版本。没有博客文章,也没有发布会。这是自 4 月 24 日起一直处于预览状态的旗舰模型的首个正式版,架构没有任何变化:混合专家结构下总参数 1.6 万亿,每个 token 激活约 490 亿,上下文一百万 token,MIT 许可证。所有变化都发生在后训练阶段,而变化最大的地方正是智能体任务。按 DeepSeek 自己公布的成绩,DeepSWE 从 12.8 升至 62.7,Terminal Bench 从 72.1 升至 87.9,Cybergym 从 52.7 升至 83.3,NL2Repo 从 38.5 升至 61.5。API 现在同时支持 Responses 与 Anthropic 两套协议,无需适配层即可接入 Codex 和 Claude Code。价格维持在每百万输入 token 3 元、每百万输出 token 6 元——但官方同时注明,价格不久后将大幅上调。

为什么重要?值得注意的不是规模,因为规模没变。同样的参数量,换一次后训练,一个 4 月在智能体编程基准上只有 12.8 分的模型,8 月拿到了 62.7 分。这说明智能体能力剩下的提升空间,大部分在训练方法上,而不在你能负担多少权重。对于要付费运行编程智能体的人来说,真正要看的是账单:每百万输出 token 约 0.84 美元,不到闭源前沿模型报价的七分之一,而且是允许自行部署的 MIT 许可证。DeepSeek 在同一处也说明了,这个价格不会一直维持。
#编程#AI智能体

✓ 已核实 · 4个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
ChatGPT 现在能读你的 iMessage 并替你发送——而那个让它不再询问的开关,正是 OpenAI 自己提醒你注意的
2026-08-21