ByteDance की Seed टीम ने बुधवार को SeedRealtime जारी किया — एक ऐसा मॉडल जो ऑडियो, वीडियो और टेक्स्ट को एक एंड-टू-एंड सिस्टम में मूल रूप से जोड़कर फुल-डुप्लेक्स संवाद करता है: बारी का इंतज़ार करने के बजाय, बोलते हुए भी देखता और सुनता रहता है। कंपनी के अनुसार यह आवाज़, दृश्य और समय को एक साथ पढ़कर समझता है कि कौन उससे बात कर रहा है और क्या चाहता है; यह Doubao असिस्टेंट ऐप में पहले से चालू है। यह अप्रैल के केवल-आवाज़ वाले Seeduplex मॉडल को दृश्य दुनिया तक ले जाता है।