aiminute. ← 全部AI新闻
新模型 2026-08-10

Meta 的新模型小到能装进你自己的电脑——也是超级智能实验室首次开放的模型

Meta 的新模型小到能装进你自己的电脑——也是超级智能实验室首次开放的模型

Meta 周一发布了 Muse Glimmer:一个 300 亿参数的模型,专为在人们已有的硬件上运行本地智能体而设计,采用宽松的 Apache 2.0 许可证。它不是混合专家架构,而是带有专用视觉编码器的稠密模型,从更大的 Muse Spark 蒸馏而来,上下文窗口为 13.1 万 token。全精度下需要超过 55 GB 显存;量化到四位后可装入 24 GB 的消费级显卡。Meta 称在 RTX 5090 上配合投机解码可达每秒约 233 个 token,约为未加速时的三倍。公布的分数在同尺寸中很强:AIME 2026 得 94.7%,GPQA Diamond 83.5,SWE-Bench Verified 76.0。在智能体专项测试中差距更大:MCP Atlas 75.5,而谷歌 Gemma4-31B 为 54.2,Qwen3.6-27B 为 62.5。但并非全面领先。Qwen3.6-27B 在 SWE-Bench Verified 上以 77.2 仍略胜一筹,并在 OSWorld-Verified 和 TerminalBench 2.1 上超过它。不支持音频输入输出;Meta 自己的模型卡说明 18 岁以下不应使用该模型。

为什么重要?这里同时发生了两件事。第一件是技术层面的:一个在工具调用和多步任务上达到这一水平的模型,如今可以在单块游戏显卡上离线运行,没有按 token 计费,也没有数据离开房间。这改变了谁能构建智能体——一所学校、一家诊所、一间只有一台工作站的小公司——也改变了智能体被允许接触什么,因为不需要把任何东西上传给别人。第二件是政治层面的。这是 Meta 超级智能实验室的首个开放模型,扎克伯格借发布之机抨击 OpenAI 和 Anthropic 把最强系统锁起来,并敦促华盛顿放松他所说的让美国实验室落后的训练数据规则。这个论点眼下之所以有分量,原因却让人不太舒服:过去一年领先的开放权重模型大多来自中国——Kimi K3、Qwen3.8-Max、DeepSeek V4-Flash——而美国最好的系统始终封闭。Meta 押注自己能成为美国的例外,并挑了现有最宽松的许可证来证明这一点。
#编程#AI智能体

✓ 已核实 · 5个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
ChatGPT 现在能读你的 iMessage 并替你发送——而那个让它不再询问的开关,正是 OpenAI 自己提醒你注意的
2026-08-21