Neue Modelle
AI Minute Newsroom
2026-08-05
ByteDances SeedRealtime schaut, hört und spricht — alles gleichzeitig
ByteDances Seed-Team hat am Mittwoch SeedRealtime veröffentlicht: ein Modell, das Audio, Video und Text nativ in einem durchgängigen System für Full-Duplex-Interaktion verschmilzt. Es schaut und hört weiter zu, während es spricht, statt sich abzuwechseln. Nach Angaben des Unternehmens liest es Ton, Bild und Timing gemeinsam, um zu erkennen, wer es anspricht und was gewünscht wird; in der Assistenten-App Doubao ist es bereits im Einsatz. Damit wird das nur sprachbasierte Seeduplex-Modell vom April in die visuelle Welt erweitert.
Warum es wichtig istFull-Duplex-Sprache war der erste Schritt; mit Augen verhält sich ein KI-Assistent weniger wie ein Walkie-Talkie und mehr wie jemand im Raum. Dass ByteDance das direkt in seinen wichtigsten Verbraucher-Assistenten bringt, zeigt: Multimodale Echtzeit-Interaktion wird das nächste Schlachtfeld der KI-Apps.
✓ Verifiziert · 2 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Microsofts neues Modell schreibt, bevor Sie fertig gesprochen haben.
2026-10-05ElevenLabs schenkt Studenten ein Jahr seiner Lesestimme.
2026-10-05Ein US-Labor verschenkt bald ein Modell auf Chinas Niveau.
2026-10-05Eine Videoseite verschenkt das beste offene Übersetzungsmodell.
2026-10-05Die Hälfte der Angerufenen hielt die KI für einen Menschen.
2026-10-04