aiminute. ← 全部AI新闻
新模型 2026-08-15

阿里对Meta本地模型的回应晚了四天——但这一个能看

阿里对Meta本地模型的回应晚了四天——但这一个能看

阿里巴巴通义千问团队于8月14日以 Apache 2.0 许可开源了 Qwen3.8-27B 的权重。这是一个270亿参数的稠密模型,而非混合专家架构,并且原生多模态:除文本外还能读取图像和视频。模型卡列出的上下文窗口为 262,144 个 token,可扩展至100万,成绩包括 Terminal Bench 2.1 得 73.0、SWE-bench Pro 得 61.7、电脑操作类的 OSWorld-Verified 得 84.3。媒体报道称常规精度下显存需求约为24GB——即一张 RTX 4090——社区的4bit量化版本据报约需17GB。Meta 曾在8月10日发布卖点几乎相同的300亿参数 Apache 2.0 模型 Muse Glimmer;那个模型只支持纯文本。

为什么重要?这里值得注意的数字不是跑分,而是显存。最近这两次接近前沿的开源发布,都被刻意做成能塞进用户手头已有的一张显卡,并配上允许把成果拿去卖钱的许可证。这与过去两周那些万亿参数开源模型是完全不同的策略:那些模型名义上开放,实际上几乎没人跑得动。如果一个能看图、能操作电脑的模型现在能装进24GB,那么你不再需要送到任何人服务器上的事情,范围就大了很多——对一所学校、一家诊所,或者一家对数据去向有规定的公司来说都是如此。
#编程#图像生成

✓ 已核实 · 4个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21