aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-22

一个 80 亿参数的模型,既能看图又能画图,还支持原生 4K,采用 Apache 许可——社区两天就跑起来了

一个 80 亿参数的模型,既能看图又能画图,还支持原生 4K,采用 Apache 许可——社区两天就跑起来了

商汤于 8 月 19 日把 SenseNova-U1.5-8B-MoT 的权重以 Apache-2.0 许可放上 Hugging Face,同日发布了一个微调版本,20 日又放出一组 LoRA。它不是流水线,而是一个原生统一的多模态模型:同样这 80 亿参数既负责看图,也负责生成和编辑图像——实验室称这套架构为 NEO-unify。发布说明列出了相对上一版的六项具体改进:构图与材质表现更好;海报和信息图中的中英文文字更清晰;原生 4K 生成效率更高;编辑时更能保住画面中不该动的部分;对同时叠加物体数量与空间关系的复杂指令执行更稳;通过检测框和参考图实现更精细的控制。更容易核实的是随后发生的事。大约四十八小时内,社区就放出了 GGUF 与 FP8 转换、ONNX 导出和一个 ComfyUI 包,模型因此能在普通桌面配置上跑起来。主仓库目前约 950 次下载、91 个赞;参考代码在 GitHub,权重同时镜像在魔搭上。有一点必须说清楚:商汤的基准对比是以图表而非表格形式发布的,目前也还没有独立评测,因此排名类说法应视为实验室的一面之词。

为什么重要?真正有意思的不是分数,而是形态。你能下载到的图像工具,大多是一个模型负责画、另一个负责看;这里是同一套权重同时干这两件事,而且小到能在你已有的机器上跑,许可证还允许你把做出来的东西拿去卖。原生 4K 的意义同样朴素:它决定了一张图是能直接做海报,还是必须先放大。而从一家中国实验室放出权重,到某个人在 Discord 里用 ComfyUI 跑起来,中间只隔两天——这已经是这个生态的常速:发布不再是一则公告,而是同一周就落到陌生人机器上的一个下载包。
#图像生成

✓ 已核实 · 4个来源

▶ 相关视频: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

新视频模型能给机器人视角拍下的画面打标签。
2026-10-07
谷歌的新搜索模型只占手机 191 兆内存。
2026-10-07
Mistral本月将免费放出万亿参数模型。
2026-10-06
Reflection要免费放出一个5010亿参数的模型。
2026-10-06
ChatGPT在伪造的漫画上签了真实漫画家的名字。
2026-10-06