aiminute. ← 全部AI新闻
新模型 2026-08-01

华为开源5050亿参数大模型,全程用自家芯片训练——完全没有英伟达

华为开源5050亿参数大模型,全程用自家芯片训练——完全没有英伟达

7月31日,华为发布了openPangu-2.0-Pro的模型权重、推理代码和技术报告:这是一个5050亿参数的混合专家模型(每个token激活约180亿参数),支持512K上下文窗口,训练数据约34万亿token。最与众不同的是硬件:整个训练过程都在华为自研的昇腾NPU上完成,没有使用任何英伟达芯片。此次发布兑现了华为在6月开发者大会上的承诺。

为什么重要?美国出口管制本意是阻止中国训练前沿规模的模型——而眼前是一个完全用国产芯片训练、连配方都公开的5050亿参数开源模型。对开源世界来说,这是又一个可供构建的重量级底座;对政策制定者来说,这是芯片高墙正在漏水的实证。

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21
模型自己出题、自己搭测试台,再拿结果训练自己——DeepReinforce 还把权重免费放了出来
2026-08-20
一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token
2026-08-18
智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%
2026-08-17