Новые модели
2026-08-05
SeedRealtime от ByteDance смотрит, слушает и говорит — всё одновременно
Команда Seed компании ByteDance в среду выпустила SeedRealtime — модель, нативно объединяющую аудио, видео и текст в единой сквозной системе для полнодуплексного взаимодействия: она продолжает смотреть и слушать, даже когда говорит, вместо того чтобы ждать своей очереди. По словам компании, модель считывает звук, изображение и тайминг вместе, чтобы понять, кто к ней обращается и чего хочет; она уже работает в приложении-ассистенте Doubao. Это расширение апрельской голосовой модели Seeduplex в визуальный мир.
Почему это важноПолнодуплексный голос был первым шагом; «глаза» превращают ИИ-ассистента из рации в собеседника, находящегося в комнате. То, что ByteDance сразу встроила это в свой флагманский потребительский ассистент, — сигнал: мультимодальное взаимодействие в реальном времени становится новым полем битвы ИИ-приложений.
✓ Проверено · 2 источников
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Apple Music будет сообщать, что песню сделала машина, — но говорить об этом или нет, решает тот, кто её загружает
2026-08-21Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21Adobe теперь сочинит музыку, начитает закадровый текст и хлопнет дверью — и уверяет, что лицензия вас прикроет
2026-08-21Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21Полгода назад Голливуд направил ByteDance требование прекратить нарушения. На этой неделе стороны подписали перемирие — и ни один доллар не перешёл из рук в руки.
2026-08-20