Bu ne?
AI video üretimi, metni veya görseli hareketli görüntüye çevirir. Üç yılda kabus gibi 2 saniyelik kliplerden; sesli, karakterleri tutarlı, kamera kontrollü dakikalık sahnelere geldi. Reklamcılığı, film ön tasarımını ve sosyal medyayı dönüştürüyor — deepfake tartışmasını da alevlendiriyor.
Önemli araçlar ve oyuncular
- Sora (OpenAI) — metinden video ve etrafına kurulan sosyal uygulama
- Veo (Google DeepMind) — sesiyle birlikte video üretimi
- Runway — film yapımcısının kontrol odaklı takımı
- Kling (Kuaishou) — Çin'in en güçlüsü, dünyada yaygın
- Pika, Luma, Hailuo — hızlı ve erişilebilir alternatifler
Dönüm noktaları
- 2023 — Runway Gen-2 ve Pika: ilk kullanılabilir metinden video
- Şubat 2024 — Sora tanıtımı sektörü sarstı: dakikalık tutarlı sahneler
- 2024 — Kling ve Veo cevap verdi; fizik gerçekçiliği hızla arttı
- 2025 — Veo 3 sesli video üretti; Sora sosyal uygulama olarak çıktı; AI reklamları televizyona girdi
- 2026 — Karakter tutarlılığı ve çok sahneli hikâye anlatımı yeni sınır
- Tem 2026 — MiniMax H3: konuşma, efekt ve müziği görüntüyle birlikte doğal stereo olarak üreten 2K klipler; ağırlıkların açılacağı duyuruldu
- Ağu 2026 — H3 sözünü tuttu: ağırlıklar yayınlandı — büyük bir video sıralamasında lider olan ilk açık model
- Ağu 2026 — FLUX 3 Video genel kullanıma açıldı: diyalog, efekt ve ortam sesi tek geçişte üretilen, bir düzine dilde dudak senkronlu 20 saniyelik klipler
- Ağu 2026 — Alibaba'nın Wan 3.0'ı kamu betasına açıldı: tek birleşik model; belge, sunum ve web sayfalarını sesli 30 saniyelik videoya çeviriyor
Mini sözlük
- Difüzyon: gürültüyü adım adım arındırarak görüntü üreten teknik
- Dünya modeli: AI'ın nesnelerin ve fiziğin nasıl davrandığına dair içsel sezgisi
- Yerleşik ses: videoyla birlikte üretilen, sonradan eklenmeyen ses