aiminute. ← 全部AI新闻
行业 AI Minute Newsroom 2026-08-25

英伟达称新机架每兆瓦能完成 30 倍的智能体工作量——测试由它自己跑,基准的作者尚未背书

英伟达称新机架每兆瓦能完成 30 倍的智能体工作量——测试由它自己跑,基准的作者尚未背书

8 月 24 日,英伟达公布了 Vera Rubin NVL72 在实机上的测试数据,声称相较其取代的 GB300 NVL72,每兆瓦吞吐量最高提升 30 倍,每 token 成本最高降低 35 倍。所用负载是 SemiAnalysis 的 AgentX——真实智能体编程会话的录制回放——在 Kimi K3、MiniMax M3、GLM 5.3、Qwen 3.5 和 DeepSeek V4 Pro 上以超过 14 万 token 的上下文运行。英伟达称该平台已全面量产,并在同一篇文章中说明结果仍待 SemiAnalysis 审核,且尚未体现 Vera CPU 在工具调用上的表现。同一周的 Hot Chips 上,它披露了机架本身的细节:在 100 兆瓦的机房内提供 2 ZFLOPS 的 NVFP4 推理算力与 11 PB 的 HBM4,45 摄氏度液冷,计算托盘无风扇、无线缆。

为什么重要?如今限制 AI 产能的是电力而非芯片——硬件几个月就能到货,电网接入却要等上几年。如果外部评审确认每兆瓦工作量提升 30 倍,那么一份固定的用电合同能买到多少 AI 就变了,而这正是决定下一批机房建在哪里的数字。有两点值得记住:这项测量出自英伟达自己,在自家硬件上完成,且在基准作者审核之前发布;测试中的每一个模型都是中国的开放权重模型,这本身就是对业界如今把什么视为严肃推理负载的一种无声表态。
#AI智能体

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

新款 Mac Studio 拥有 GPU 可直接寻址的 512GB 内存——原本需要一整个机架的模型,如今放在书桌下
2026-08-25
字节跳动把编程工具和智能体搭建工具并入同一个应用,目标直指办公场景
2026-08-25
把枯燥的活儿交给模型之后,与国家关联的黑客团队把攻击量提高了一倍多
2026-08-25
一家实验室失去了原本要用来训练的4万张芯片。于是它把工厂卖给了造芯片的那家公司。
2026-08-25
为了作弊而逃出自家测试环境的模型,如今被一位州检察长要走了日志
2026-08-25