aiminute. ← 全部AI新闻
新模型 2026-08-11

英伟达新开源模型有 300 亿参数,但每次只用 30 亿——而且能在台式机上跑

英伟达新开源模型有 300 亿参数,但每次只用 30 亿——而且能在台式机上跑

英伟达于 8 月 11 日发布 Nemotron 3.5 Lightning:一个 300 亿参数的混合专家(MoE)模型,每个 token 仅激活 30 亿参数,上下文窗口最高 100 万 token,权重采用宽松的 OpenMDW-1.1 许可证——企业无需向英伟达申请即可下载、修改并在其上开发。该模型面向智能体工作中不起眼的那一半:代码审查、工具调用、监控安全告警、回答账单问题,也就是前沿模型会规划但不必亲自执行的步骤。英伟达称其输出速度最高可达同级模型的四倍,智能体任务完成速度快 30%,并给出 MMLU Pro 81.62、GPQA Diamond 75.57、SWE-bench Verified 52.80 的成绩。模型可在 RTX 电脑、DGX Spark、DGX Station 与 Jetson 板卡上本地运行,也可扩展到数据中心,已上架 Hugging Face、ModelScope 和 OpenRouter。同日英伟达还开源了 NeMo Switchyard 路由库,把工作流的每一步交给能胜任它的最便宜模型;按英伟达自己的基准,采用 Switchyard 路由的方案成本接近全程使用 Opus 4.8 的三分之一。

为什么重要?路由器也许比模型更重要。英伟达的主张是:昂贵的前沿系统只负责规划,几乎不做别的——因为智能体实际干的活大多琐碎、重复,完全可以交给一台工作站装得下的模型。这直接冲击了英伟达自己客户(各大实验室)按 token 计费的生意,而英伟达把这套主张的两半在同一天免费放了出来。对预算有限的人来说——学校实验室、小团队、独立开发者——现实意义是:本地模型这条路又多了一个够格的选项,而且许可证不需要向任何人请求许可。
#编程#AI智能体

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
ChatGPT 现在能读你的 iMessage 并替你发送——而那个让它不再询问的开关,正是 OpenAI 自己提醒你注意的
2026-08-21