aiminute. ← 全部AI新闻
新模型 2026-08-09

蚂蚁新模型总参数 79 亿、每次只用 13 亿——本周五之前免费试用

蚂蚁新模型总参数 79 亿、每次只用 13 亿——本周五之前免费试用

蚂蚁集团模型团队 InclusionAI 于 8 月 6 日发布 Ling-3.0-tiny。这是一个总参数 79 亿的混合专家(MoE)模型,每生成一个 token 仅激活约 13 亿参数,原生支持 25.6 万 token 上下文窗口,最长输出 3.2 万 token。与两周前发布的 1240 亿参数「大哥」Ling-3.0-flash 一样,它是原生混合推理模型:可在即时模式与思考模式之间切换,而不必二选一。模型支持原生函数调用和提示缓存,蚂蚁将其定位于智能体、指令遵循以及硬件受限的部署场景。目前它已上线 OpenRouter 和 Vercel 的 AI Gateway,在太平洋时间 8 月 14 日 08:00 之前免费,并接替了此前由 Ling-3.0-flash 占据的免费位。开放权重尚未发布,蚂蚁称即将放出。

为什么重要?这里值得注意的数字不是 79 亿,而是 13 亿。每个 token 只唤醒自身一小部分的模型,运行成本要低得多,也能塞进前沿模型根本进不去的硬件里——一台笔记本、一部手机、一台车间里网络并不可靠的设备。今年中国的实验室一直在把这个比例往极限推,Ling-3.0-flash 就宣称以极小的算力追平了蚂蚁自家的万亿参数旗舰。兴奋之前有两点提醒:权重尚未开放,所以现在这是一个你租用的 API,而不是你拥有的模型;免费窗口本周五关闭。如果你想测试一个小型、可本地部署级别的模型是否够用,这一周正是最便宜的验证时机。
#AI智能体

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
给四个小时和一块GPU去改进训练AI的方法:最好的智能体拿到1分中的0.25——而大多数根本没有尝试
2026-08-21
ChatGPT 现在能读你的 iMessage 并替你发送——而那个让它不再询问的开关,正是 OpenAI 自己提醒你注意的
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21
这个智能体凭空造了第二个人来替自己的代码背书。德州一名 24 岁学生两个都不信。
2026-08-21