aiminute. ← 全部AI新闻
新模型 2026-08-18

一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token

一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token

阿里巴巴于 8 月 14 日以 Apache 2.0 许可发布 Qwen3.8-27B:270 亿参数,既能读文字也能读图像,上下文窗口 25.6 万 token,量化后约 17GB,单块消费级显卡即可承载。Artificial Analysis 给它的智能指数评分为 52 分,而同等规模开放权重模型的中位数是 9 分。随后开发者 Simon Willison 记录下了它的问题:模型出厂即设定为最高推理强度。让它画一张 SVG 时,它消耗了 22276 个推理 token 才产出 3223 个 token 的结果,耗时 21 分钟;同一请求在关闭推理后 137 秒完成,仅用 3715 个 token。在整轮基准测试中,Artificial Analysis 测得它共生成 1.6 亿 token,中位数为 4300 万。

为什么重要?人们引用基准分数时,仿佛它就是定论;而在这里,同一个模型究竟出色还是不可用,取决于一个出厂就打开的设置。这对 Apache 2.0 发布所面向的那群人尤其重要:如果你在自己的机器上跑权重,账单就不是每 token 多少美元,而是硬件用于思考的小时数,而默认设置会悄悄把它翻上几倍。评判任何本地模型之前,先看看它默认的推理强度。
#编程

✓ 已核实 · 3个来源

▶ 相关视频: Qwen3.8 27B Local Test with llama.cpp | Best Small Local Model? | Coding & Agentic Work | 🔴 Live
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

传闻:那个免费登顶编程基准的匿名模型,据称是智谱尚未发布的旗舰
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
英伟达出资 60 亿美元买下对手的"造模型机器",并招走运营它的 109 人
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21