Новые модели
AI Minute Newsroom
2026-08-25
Видеомодель, которой управляешь стрелками, пока она ещё генерирует, — и компания признаёт, что выглядит она хуже офлайновых
Китайская компания Aishi Technology, стоящая за PixVerse, объявила о R2 23 августа. Это преемник R1, который в январе стал первой видеомоделью, работавшей как непрерывный поток, с которым можно взаимодействовать, а не как клип, который ждёшь, а потом смотришь. R2 заявляет, что тот же цикл реального времени теперь держится на более длинных отрезках и принимает больше видов ввода одновременно. Архитектурно компания говорит, что свернула прежнюю цепочку этапов обучения в две: омнимодальный каузальный авторегрессионный процесс, расширяющий то, что модель мира способна порождать, и слой ускорения реального времени, который возвращает эти способности к интерактивной скорости. Компонент, названный Dynamic Chunk, подстраивается под темп пользователя — набранные подсказки, голос или прямое управление. Демонстрации необычно конкретны в части предполагаемого применения: перемещение по сгенерированной сцене с помощью WASD и стрелок, ветвление сюжета через ввод текста, разговор с персонажем, отвечающим в реальном времени. Aishi нацеливает это на интерактивные развлечения — игры, интерактивную драму, виртуальный стриминг, — а не на генерацию киношного типа, и прямо пишет в собственной публикации, что качество картинки у R2 всё ещё уступает лучшим офлайновым видеомоделям, особенно на сложных сценах и на длинных отрезках. Ни даты выпуска, ни доступности, ни цены не объявлено.
Почему это важноИнтересна открыто заявленная уступка. Почти все видеомодели соревнуются в том, насколько хорошо выглядит готовый клип; эта намеренно отдаёт часть этого, чтобы кадры продолжали поступать, пока вы ещё жмёте клавиши, — а это другой продукт с другой мерой успеха. То, что компания говорит об этом в собственном анонсе, а не заявляет одновременно и то и другое, стоит больше любой архитектурной детали. К остальному — обычная осторожность: опубликованы исследовательская заметка и набор демонстраций, без цифр бенчмарков, без публичной сборки и без цены. Интерактивная генерация в реальном времени — ровно тот тип возможности, который выглядит выдающимся в отобранном фрагменте и разочаровывает в первые десять минут реального использования, и пока кто-то вне компании не сможет подержать стрелки нажатыми подольше, этот разрыв остаётся неизмеренным. Стоит следить, если вы работаете где-то рядом с играми или видео: если этот класс моделей действительно выдержит, то генерируемое перестаёт быть файлом и начинает быть местом.
✓ Проверено · 2 источников
▶ Видео по теме: PixVerse R1 — First Real-Time World Model? Infinite 1080p Video Generation Explained
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Новая видеомодель Alibaba принимает на вход вашу презентацию и возвращает тридцать секунд фильма
2026-08-24Alibaba обучила модель на стойке из 100 настоящих телефонов — теперь она выполняет 92 задачи из 100 на реальном устройстве
2026-08-23Модель на восемь миллиардов параметров, которая и читает картинки, и рисует их в 4K, под лицензией Apache — сообщество запустило её за два дня
2026-08-22Открытые модели Google скачали миллиард раз, а сторонние разработчики собрали из них 100 000 версий
2026-08-22Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21