Nuevos Modelos
2026-08-05
SeedRealtime de ByteDance mira, escucha y habla — todo al mismo tiempo
El equipo Seed de ByteDance lanzó el miércoles SeedRealtime, un modelo que fusiona de forma nativa audio, video y texto en un único sistema de extremo a extremo para la interacción full-duplex: sigue mirando y escuchando incluso mientras habla, en lugar de esperar turnos. La empresa dice que interpreta juntos el sonido, las imágenes y los tiempos para deducir quién se dirige a él y qué quiere, y ya funciona en la app de asistente Doubao. Extiende al mundo visual el modelo Seeduplex de abril, que era solo de voz.
Por qué importaLa voz full-duplex fue el primer paso; añadir ojos hace que un asistente de IA se parezca menos a un walkie-talkie y más a alguien presente en la habitación. Que ByteDance lo lleve directo a su asistente de consumo insignia señala que la interacción multimodal en tiempo real se está convirtiendo en el próximo campo de batalla de las apps de IA.
✓ Verificado · 2 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
Apple Music dirá cuándo una canción la hizo una máquina — pero quien la sube decide si lo declara
2026-08-21El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Adobe ya genera la música, la locución y el portazo — y dice que la licencia te cubre
2026-08-21Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21Hace seis meses Hollywood mandó a ByteDance un requerimiento legal. Esta semana firmaron una tregua, y no cambió de manos ni un dólar.
2026-08-20