aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-28

谷歌的视频模型现在可以被告知一个镜头从哪里开始、到哪里结束——草稿的成本只有三分之一

谷歌的视频模型现在可以被告知一个镜头从哪里开始、到哪里结束——草稿的成本只有三分之一

2026年8月27日星期四,谷歌发布了 Gemini Omni 1.1 Flash,这是其视频生成模型面向生产环境的更新,目标用户是搭建工具和工作流的人,而非只做单条片子的用户。新增四项能力。场景延展以10秒为单位把片段延长至最多40秒,并且现在会读取此前最多10秒的画面作为上下文,而不是只看最后一瞬——正是这一点让延展在视觉上保持连贯。关键帧控制允许你提供首帧和尾帧,由模型生成两者之间的过渡与运镜。360p 预览模式生成粗剪草稿的速度最高提升60%,成本仅为标准720p输出的三分之一,迭代循环因此不再昂贵。视频参考则让提示词引用最多三秒的既有素材,以在多个镜头间保持角色或画面风格稳定。成片可升采样至1080p或4K。该模型已在 Google AI Studio、Gemini Enterprise Agent Platform API,以及面向 Plus、Pro 和 Ultra 订阅者的 Google Flow 中提供;场景延展也将进入付费层级的 Gemini 应用。

为什么重要?生成式视频的难点从来不是一条漂亮的片段——而是让第二个镜头与第一个对得上。关键帧和视频参考都是针对这一点的尝试:它们让人可以指定连贯性,而不是祈祷连贯性出现。便宜的360p草稿模式之所以重要,是从同一问题的另一端切入。当一条废片只花三分之一的钱、来得快一倍时,工作流就开始更像剪辑,而不像赌博。
#视频

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

谷歌的新转写模型写下的不是你说出的话,而是你想说的话——支持85种语言
2026-08-28
一千万小时视频公开供任何人训练——迄今最大的开放视频数据集来自一家德国非营利机构
2026-08-27
开发者摸了几周的匿名模型现在以MIT许可开放下载——智谱称整个预览全程跑在国产芯片上
2026-08-27
IBM 的新开源模型不是靠读教程学会用终端的,而是靠真的去用
2026-08-27
六天吞下 42 万亿 token 的无名模型有了主人:智谱确认 Ox Alpha 是 GLM 新版本,权重即将开放
2026-08-26