Meta在9月1日发布了首个实时语音模型Muse Voice Transcribe。一次处理就写出文字、分出说话人,并在话音落下0.16秒后给出终稿。Meta不放权重,只按每千分钟音频三美元卖接口。
✓ 已核实 · 4个来源