aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-05

SeedRealtime de ByteDance regarde, écoute et parle — tout en même temps

SeedRealtime de ByteDance regarde, écoute et parle — tout en même temps

L'équipe Seed de ByteDance a publié mercredi SeedRealtime, un modèle qui fusionne nativement audio, vidéo et texte dans un seul système de bout en bout pour une interaction full-duplex : il continue de regarder et d'écouter même pendant qu'il parle, au lieu d'attendre son tour. L'entreprise explique qu'il lit ensemble le son, l'image et le tempo pour déterminer qui s'adresse à lui et ce qu'on lui demande ; il est déjà en service dans l'application d'assistant Doubao. Il étend au monde visuel le modèle Seeduplex d'avril, limité à la voix.

Pourquoi c'est importantLa voix full-duplex était la première étape ; ajouter des yeux rapproche l'assistant IA de quelqu'un présent dans la pièce plutôt que d'un talkie-walkie. Que ByteDance l'intègre directement à son assistant grand public phare montre que l'interaction multimodale en temps réel devient le prochain champ de bataille des applications d'IA.
#Vidéo#Audio & Musique

✓ Vérifié · 2 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05
ElevenLabs offre aux étudiants un an de sa voix de lecture.
2026-10-05
Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05
Un site de vidéo offre le meilleur modèle ouvert de traduction.
2026-10-05
La moitié des appelés ont cru parler à un humain en vidéo.
2026-10-04