aiminute. ← 全部AI新闻
新模型 2026-08-05

FLUX 3 Video 向所有人开放:自带声音的 20 秒视频片段

FLUX 3 Video 向所有人开放:自带声音的 20 秒视频片段

继 7 月多模态 FLUX 3 模型的限量发布后,Black Forest Labs 于周二通过 API 全面开放了 FLUX 3 Video。该模型可生成最长 20 秒的 720p 或 1080p 片段,音频在同一次生成中完成——对话、音效和环境声,无需后期唇形同步——并支持包括英语、中文、西班牙语、印地语和土耳其语在内的十多种语言。它还支持图生视频、关键帧编辑、视频续写和多镜头序列。

为什么重要?声音一直是 AI 视频缺失的另一半——多数竞品都是事后拼接。画面与音频同步生成,并以开放 API 而非封闭应用的形式推出,让这家以开放权重图像模型闻名的欧洲实验室,把 Sora 级工具直接交到了开发者手中。
#视频#音频与音乐

✓ 已核实 · 2个来源

▶ 相关视频: FLUX 3 Might Be the Open Source Sora 2 We Deserve
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Apple Music 将标注哪些歌曲由机器生成——但要不要说,取决于上传者
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
Adobe 现在能生成配乐、旁白和关门声——而且它说授权已经替你兜底
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21
六个月前,好莱坞向字节跳动发出停止侵权函。本周双方签下休战协议——没有一分钱易手。
2026-08-20