aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-28

On peut désormais dire au modèle vidéo de Google où un plan commence et où il finit — et les brouillons coûtent trois fois moins cher

On peut désormais dire au modèle vidéo de Google où un plan commence et où il finit — et les brouillons coûtent trois fois moins cher

Google a publié le jeudi 27 août 2026 Gemini Omni 1.1 Flash, une mise à jour de production de son modèle de génération vidéo destinée à ceux qui construisent des outils et des chaînes de travail plutôt qu'à ceux qui produisent un clip isolé. Quatre nouveautés. L'extension de scène rallonge un clip par tranches de 10 secondes, jusqu'à 40 secondes, et lit désormais jusqu'à 10 secondes d'images précédentes comme contexte au lieu du seul dernier instant, ce qui assure la cohérence visuelle du prolongement. Le contrôle par images clés permet de fournir une première et une dernière image et de laisser le modèle générer la transition et le mouvement de caméra entre les deux. Un mode aperçu en 360p produit des brouillons jusqu'à 60 % plus vite et pour un tiers du coût d'une sortie standard en 720p, si bien qu'itérer cesse d'être onéreux. Les références vidéo permettent à une instruction de citer jusqu'à trois secondes de séquences existantes pour maintenir un personnage ou un rendu d'un plan à l'autre. Le résultat final peut être remonté en 1080p ou 4K. C'est accessible dans Google AI Studio, via l'API de la Gemini Enterprise Agent Platform et dans Google Flow pour les abonnés Plus, Pro et Ultra ; l'extension de scène arrive également dans l'application Gemini sur les formules payantes.

Pourquoi c'est importantLa difficulté de la vidéo générative n'a jamais été un beau plan isolé : c'était que le deuxième plan raccorde avec le premier. Les images clés et les références vidéo visent exactement cela : elles permettent de spécifier la continuité plutôt que de l'espérer. Le mode brouillon bon marché en 360p compte pour la même raison, par l'autre bout. Quand une mauvaise prise coûte trois fois moins et arrive deux fois plus vite, le flux de travail se met à ressembler à du montage plutôt qu'à un pari.
#Vidéo

✓ Vérifié · 2 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le nouveau modèle de transcription de Google n'écrit pas ce que vous avez dit, mais ce que vous vouliez dire — en 85 langues
2026-08-28
Dix millions d'heures de vidéo, publiées pour que n'importe qui puisse s'y entraîner — le plus grand jeu vidéo ouvert à ce jour vient d'une association allemande
2026-08-27
Le modèle anonyme que les développeurs sondaient depuis des semaines est désormais téléchargeable sous licence MIT — et Z.ai affirme que toute la préversion a tourné sur des puces chinoises
2026-08-27
Les nouveaux modèles ouverts d'IBM n'ont pas appris à décrire un terminal : on les a entraînés en s'en servant
2026-08-27
Le modèle anonyme qui a avalé 42 000 milliards de jetons en six jours a un propriétaire : Z.ai reconnaît qu'Ox Alpha est un GLM et ouvre les poids
2026-08-26