aiminute. ← AIニュース一覧
新モデル AI Minute Newsroom 2026-09-14

シャオミの公開モデルは、三人が同時に話しても一人だけ書き取る。

シャオミの公開モデルは、三人が同時に話しても一人だけ書き取る。

シャオミが金曜日、無料の音声モデルCocktailASR-1を公開した。対象の人の声を短く聞かせると、それ以外の声は背景として無視する。三人が重なる試験では単語の12.29%を、二人なら4.11%を誤った。

なぜ重要か二人の声が重なった瞬間から、議事録も字幕も崩れてしまう。重みが公開されているので、この処理は会社のサーバーではなく手元の機械で動かせる。
#音声・音楽

✓ 検証済み · 3ソース

▶ 関連動画: Solving the Cocktail Party Problem with Deep Learning (In-depth version)
WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

ディープシークが初の音声機能を一部の利用者に試している。
2026-09-14
ElevenLabsの新音楽モデルは無料利用者にも販売を許した。
2026-09-13
中国の小売大手が、歩くたびに世界を描く無料モデルを公開した。
2026-09-13
Kimiの安い開発向けモデルが百万トークンを全員に開いた
2026-09-12
中国の地図会社が、飛び込める三次元の世界を作った。
2026-09-11