aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-05

字节跳动 SeedRealtime:边看、边听、边说,同时进行

字节跳动 SeedRealtime:边看、边听、边说,同时进行

字节跳动 Seed 团队周三发布了 SeedRealtime——一个在端到端系统中原生融合音频、视频与文本的全双工交互模型:它在说话的同时仍在观察和倾听,而不是轮流对话。公司称,模型会综合声音、画面与时序信息,判断谁在对它说话、想要什么,目前已在豆包助手应用中上线。它把 4 月发布的纯语音模型 Seeduplex 扩展到了视觉世界。

为什么重要?全双工语音是第一步;加上"眼睛",AI 助手就不再像对讲机,而更像屋子里的一个人。字节跳动将其直接装进旗舰消费级助手,表明实时多模态交互正成为 AI 应用的下一个竞争焦点。
#视频#音频与音乐

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

微软的新模型在你说完之前就开始写字了。
2026-10-05
ElevenLabs给学生免费送一年的朗读声音。
2026-10-05
一家美国实验室即将免费放出对标中国的开源模型。
2026-10-05
一家视频网站免费放出了评分最高的开源翻译模型
2026-10-05
短暂视频通话里,一半人以为对面的AI是真人
2026-10-04