蚂蚁集团模型团队 InclusionAI 于 8 月 6 日发布 Ling-3.0-tiny。这是一个总参数 79 亿的混合专家(MoE)模型,每生成一个 token 仅激活约 13 亿参数,原生支持 25.6 万 token 上下文窗口,最长输出 3.2 万 token。与两周前发布的 1240 亿参数「大哥」Ling-3.0-flash 一样,它是原生混合推理模型:可在即时模式与思考模式之间切换,而不必二选一。模型支持原生函数调用和提示缓存,蚂蚁将其定位于智能体、指令遵循以及硬件受限的部署场景。目前它已上线 OpenRouter 和 Vercel 的 AI Gateway,在太平洋时间 8 月 14 日 08:00 之前免费,并接替了此前由 Ling-3.0-flash 占据的免费位。开放权重尚未发布,蚂蚁称即将放出。