aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-18

一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token

一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token

阿里巴巴于 8 月 14 日以 Apache 2.0 许可发布 Qwen3.8-27B:270 亿参数,既能读文字也能读图像,上下文窗口 25.6 万 token,量化后约 17GB,单块消费级显卡即可承载。Artificial Analysis 给它的智能指数评分为 52 分,而同等规模开放权重模型的中位数是 9 分。随后开发者 Simon Willison 记录下了它的问题:模型出厂即设定为最高推理强度。让它画一张 SVG 时,它消耗了 22276 个推理 token 才产出 3223 个 token 的结果,耗时 21 分钟;同一请求在关闭推理后 137 秒完成,仅用 3715 个 token。在整轮基准测试中,Artificial Analysis 测得它共生成 1.6 亿 token,中位数为 4300 万。

为什么重要?人们引用基准分数时,仿佛它就是定论;而在这里,同一个模型究竟出色还是不可用,取决于一个出厂就打开的设置。这对 Apache 2.0 发布所面向的那群人尤其重要:如果你在自己的机器上跑权重,账单就不是每 token 多少美元,而是硬件用于思考的小时数,而默认设置会悄悄把它翻上几倍。评判任何本地模型之前,先看看它默认的推理强度。
#编程

✓ 已核实 · 3个来源

▶ 相关视频: Qwen3.8 27B Local Test with llama.cpp | Best Small Local Model? | Coding & Agentic Work | 🔴 Live
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

微软的新模型在你说完之前就开始写字了。
2026-10-05
一家美国实验室即将免费放出对标中国的开源模型。
2026-10-05
一家视频网站免费放出了评分最高的开源翻译模型
2026-10-05
OpenAI 承诺28天每天上新,做不到就重置额度
2026-10-05
大量AI写的报告让谷歌暂停了开源漏洞赏金。
2026-10-04