aiminute. ← AIニュース一覧
新モデル 2026-08-05

ByteDance の SeedRealtime——見て、聞いて、話す、すべて同時に

ByteDance の SeedRealtime——見て、聞いて、話す、すべて同時に

ByteDance の Seed チームは水曜日、SeedRealtime を公開した。音声・映像・テキストをエンドツーエンドの単一システムでネイティブに融合した全二重(フルデュプレックス)対話モデルで、順番を待つのではなく、話している間も見続け、聞き続ける。同社によれば、音・映像・タイミングを合わせて読み取り、誰が話しかけているのか、何を求めているのかを判断する。すでにアシスタントアプリ「豆包(Doubao)」で稼働中だ。4月公開の音声のみのモデル Seeduplex を視覚の世界へ拡張したものとなる。

なぜ重要か全二重の音声対話は第一歩だった。「目」が加わることで、AI アシスタントはトランシーバーではなく、同じ部屋にいる人間のように振る舞い始める。ByteDance がこれを主力の消費者向けアシスタントに直接搭載したことは、リアルタイムのマルチモーダル対話が AI アプリの次の主戦場になることを示している。
#動画#音声・音楽

✓ 検証済み · 2ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

アップル・ミュージックは機械が作った曲を知らせる——ただし、そう申告するかは投稿者しだい
2026-08-21
ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
Adobeが音楽もナレーションもドアの閉まる音も生成する——しかも権利処理は済んでいるという
2026-08-21
ロボットに一度見せるだけ——3秒から12秒——訓練なしで100回中59回、仕事をこなす
2026-08-21
半年前、ハリウッドはバイトダンスに警告書を送った。今週、両者は休戦に署名した——金は一銭も動いていない。
2026-08-20