aiminute. ← AIニュース一覧
新モデル AI Minute Newsroom 2026-08-28

グーグルの動画モデルに、ショットの始点と終点を指定できるようになった——下書きのコストは3分の1

グーグルの動画モデルに、ショットの始点と終点を指定できるようになった——下書きのコストは3分の1

グーグルは2026年8月27日木曜日、動画生成モデルの実運用向けアップデート Gemini Omni 1.1 Flash を公開した。狙いは単発のクリップを作る人ではなく、ツールやワークフローを組む人である。新機能は4つ。シーン延長はクリップを10秒刻みで最大40秒まで伸ばし、直前の一瞬だけでなく最大10秒ぶんの映像を文脈として読むようになった。これが延長部分の見た目の一貫性を支える。キーフレーム制御では最初と最後のフレームを与え、その間の遷移とカメラワークをモデルに生成させられる。360pプレビューモードは粗い下書きを最大60パーセント速く、標準の720p出力の3分の1のコストで生成するため、反復のループが高くつかなくなる。ビデオリファレンスはプロンプトから既存映像を最大3秒引用させ、キャラクターや画づくりをショットをまたいで保つ。仕上げは1080pまたは4Kにアップスケールできる。提供先は Google AI Studio、Gemini Enterprise Agent Platform の API、そして Plus・Pro・Ultra 契約者向けの Google Flow で、シーン延長は有料プランの Gemini アプリにも導入される。

なぜ重要か生成動画の難所は、美しい1本のクリップではなかった。2つ目のショットを1つ目に合わせることだった。キーフレームもビデオリファレンスも、その一点への挑戦である。連続性を祈るのではなく、指定できるようにする。安価な360pの下書きモードが効くのは、同じ問題を逆側から攻めるからだ。失敗テイクのコストが3分の1、到着が2倍速になると、ワークフローは賭けというより編集に近づいていく。
#動画

✓ 検証済み · 2ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

グーグルの新しい文字起こしモデルは、話した内容ではなく言おうとした内容を書く——85言語で
2026-08-28
1000万時間の動画が誰でも学習に使える形で公開——これまでで最大の公開動画データセットはドイツの非営利団体から
2026-08-27
開発者が数週間つついていた匿名モデルがMITライセンスで公開に——Z.aiは「プレビューはすべて中国製チップで動かした」と主張
2026-08-27
IBMの新しいオープンモデルは、端末の使い方を教わったのではない。実際に端末を使って鍛えられた
2026-08-27
6日間で42兆トークンを処理した無名モデルに持ち主が現れた:Z.ai が Ox Alpha を自社の GLM だと認め、重みを公開へ
2026-08-26