aiminute. ← 全部AI新闻
新模型 2026-08-05

字节跳动 SeedRealtime:边看、边听、边说,同时进行

字节跳动 SeedRealtime:边看、边听、边说,同时进行

字节跳动 Seed 团队周三发布了 SeedRealtime——一个在端到端系统中原生融合音频、视频与文本的全双工交互模型:它在说话的同时仍在观察和倾听,而不是轮流对话。公司称,模型会综合声音、画面与时序信息,判断谁在对它说话、想要什么,目前已在豆包助手应用中上线。它把 4 月发布的纯语音模型 Seeduplex 扩展到了视觉世界。

为什么重要?全双工语音是第一步;加上"眼睛",AI 助手就不再像对讲机,而更像屋子里的一个人。字节跳动将其直接装进旗舰消费级助手,表明实时多模态交互正成为 AI 应用的下一个竞争焦点。
#视频#音频与音乐

✓ 已核实 · 2个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Apple Music 将标注哪些歌曲由机器生成——但要不要说,取决于上传者
2026-08-21
DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
Adobe 现在能生成配乐、旁白和关门声——而且它说授权已经替你兜底
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21
六个月前,好莱坞向字节跳动发出停止侵权函。本周双方签下休战协议——没有一分钱易手。
2026-08-20