aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-24

阿里巴巴的新视频模型可以直接吃下你的幻灯片,吐出三十秒成片

阿里巴巴的新视频模型可以直接吃下你的幻灯片,吐出三十秒成片

阿里云在8月24日周一将Wan3.0推出公测,通过微信发布消息。它主打的不是输出端而是输入端:除文本、图像、音频和视频之外,模型还接受文档、电子表格、幻灯片、PDF以及以网址给出的网页,并据此构建一段视频。阿里巴巴把这项能力称为全能参考(Omni-Reference)。单条片段最长30秒,是Wan2.7-Video的15秒上限的两倍,并且用一个统一模型取代了此前分开的产品线。它还会根据提示词推荐合适时长,并可对已有片段做续写延展。Wan3.0自8月6日起进入公测,阿里巴巴称此后已被用于短剧和影视制作、广告营销、文旅推广和音乐视频。模型通过阿里云百炼和Qwen Cloud以wan3.0-video提供;权重未公开,API也尚未完全开放。这次发布与阿里巴巴100亿美元的配股同日落地,那是港股上市公司有史以来规模最大的一次首次增发,募资用于人工智能投入。

为什么重要?你能叫得出名字的视频模型,几乎都是从一句话或一张图开始的。把模型对准一份PDF或一份季度汇报,改变的是它服务的对象。做培训视频、产品讲解或文旅宣传片的人,内容早就有了,只是载体不对,而凭空想出画面从来不是难点。三十秒这个数字也比听上去重要:大致就是在这个长度上,一段片子不再只是演示,而开始成为可以拿给客户看的东西。代价还是今年中国前沿发布的老问题——能力公布了,权重没有,访问要经过一个你必须登录的云。
#视频

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

阿里巴巴用一整架100部真实手机训练模型——如今在真机上100个任务能完成92个
2026-08-23
一个 80 亿参数的模型,既能看图又能画图,还支持原生 4K,采用 Apache 许可——社区两天就跑起来了
2026-08-22
谷歌的开放模型已被下载十亿次,外部开发者做出了10万个版本
2026-08-22
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
Adobe 现在能生成配乐、旁白和关门声——而且它说授权已经替你兜底
2026-08-21