aiminute. ← 全部AI新闻
工具 AI Minute Newsroom 2026-09-04

Meta的新模型能在同时说话的20人里分清谁是谁。

Meta的新模型能在同时说话的20人里分清谁是谁。

Meta在9月1日发布了首个实时语音模型Muse Voice Transcribe。一次处理就写出文字、分出说话人,并在话音落下0.16秒后给出终稿。Meta不放权重,只按每千分钟音频三美元卖接口。

为什么重要?实时字幕和会议记录,过去要把三个模型硬拼在一起才做得到。合成一个之后,整天开着转写也便宜得起。
#音频与音乐

✓ 已核实 · 4个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Runway 的新模型能实时生成每秒 24 帧的可玩世界。
2026-09-05
攻击者正从热门AI搭建工具里偷走OpenAI密钥
2026-09-04
美国医生现在可以把病历调进ChatGPT。
2026-09-03
Jio 把云端电脑送进印度的旧机器里。
2026-09-03
这个工具靠改情节而不是换词来掩盖AI写作痕迹。
2026-09-02