aiminute. ← 全部AI新闻
行业 2026-08-19

同样的芯片,同样的工厂,大约两倍的主频——以及一个耗电相当于四十户人家的机柜

同样的芯片,同样的工厂,大约两倍的主频——以及一个耗电相当于四十户人家的机柜

Cerebras 于8月18日发布 CS-4,这是它称为 Nexus 的机柜级平台中的第一台机器。一个机柜最多容纳三片餐盘大小的晶圆,合计提供750 PFLOPS 的稀疏 FP16 算力、每秒129.6 PB 的内存带宽、每秒7.2 Tb 的输入输出,以及132 GB 的片上内存。公司称其速度最高可达 CS-3 的两倍,在前沿模型上每用户每秒生成的 token 数最高可达 GPU 系统的30倍。硅片本身并不新:仍是同样的台积电5纳米设计,《The Register》推算,性能翻倍主要来自把主频提高到大约两倍,约2.8 GHz,这使每片晶圆的功耗估计达到33千瓦,整个机柜达到120至140千瓦。首批系统将于本季度晚些时候上线。Cerebras 还把自己的机柜与 AMD Helios 系统和 AWS Trainium 芯片配对:后者负责读取提示的那一半工作,Cerebras 负责生成答案的那一半。

为什么重要?标题上的数字要细读。750 PFLOPS 依赖稀疏性,而稀疏性通常对语言模型推理帮助不大;峰值内存带宽也可能是理论值而非可达值——《The Register》对这两点都提出了质疑。没有疑问的是方向:把一个模型快速交付给一位没耐心的用户,最快的办法已不再是更多芯片,而是更热的芯片,而电费是最诚实的度量。一个耗电140千瓦的机柜,不是你能插进现有机房的设备,而是重建一座机房的理由。

✓ 已核实 · 3个来源

▶ 相关视频: Beyond GPUs: Cerebras' Wafer-Scale Engine for Lightning-Fast AI Inference
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Anthropic 预计募资规模比肩 SpaceX——史上最大 IPO——并可能本月公开递表
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给AI答案打分的医生和律师,如今是一门五亿美元的生意——而这家公司八个月增长了五倍
2026-08-21
企业 AI 支出仍是 Anthropic 领先。但自五月以来,差距第一次不是在拉大,而是在收窄。
2026-08-21
阿里巴巴的人工智能业务增速创五年半新高。利润下滑约75%。
2026-08-20