シャオミが金曜日、無料の音声モデルCocktailASR-1を公開した。対象の人の声を短く聞かせると、それ以外の声は背景として無視する。三人が重なる試験では単語の12.29%を、二人なら4.11%を誤った。
✓ 検証済み · 3ソース