aiminute
.
← 全部AI新闻
#音频与音乐
这是什么?
AI 音频同时经历三场革命:从文字提示生成音乐、与真人难以区分的语音,以及实时对话。它已带来登上排行榜的 AI 歌曲、有声书和语音客服的爆发——以及首批重大版权判决。
关键工具与玩家
Suno、Udio — 从提示生成完整歌曲(人声、歌词、编曲)
ElevenLabs — 逼真语音与声音克隆的领军者
OpenAI / Google 语音模式 — 实时对话语音
开源:MusicGen(Meta)、Bark、转录用 Whisper
里程碑
2022 — Whisper 让近乎完美的转录免费
2023 — MusicGen 发布;病毒式传播的"假 Drake"歌曲迫使行业回应
2024 — Suno 和 Udio 推出电台级歌曲;各大唱片公司起诉两者
2025 — 实时语音客服取代呼叫中心排队;声音克隆诈骗上升
2026 — 慕尼黑法院在欧洲首个重大 AI 音乐版权案中判 Suno 败诉(见我们的报道)
2026 年 7 月 — OpenAI 在 ChatGPT 语音中嵌入 Google DeepMind 的隐形 SynthID 水印并开放验证 API——竞争对手向同一溯源标准靠拢(见我们的报道)
2026年8月 — 字节跳动 SeedRealtime 让全双工走向音视频:同时看、听、说,已在豆包应用上线
2026年8月 — Spotify 给「AI Persona」账号加标识,并默认将其移出推荐:第一个让「做 AI 艺人」付出代价的大平台(见我们的报道)
迷你词典
TTS:文字转语音——把文字变成自然语音
声音克隆:用短样本复制特定人的声音
分轨(Stem):歌曲中的独立音轨(人声、鼓等)
该话题的新闻
Apple Music 将标注哪些歌曲由机器生成——但要不要说,取决于上传者
2026-08-21
Adobe 现在能生成配乐、旁白和关门声——而且它说授权已经替你兜底
2026-08-21
亚马逊原本要收每月 19.99 美元的助手,现在在 Fire TV 上免费了——而且没人需要注册任何东西
2026-08-20
Spotify 要给「不是人」的艺人打标签——并悄悄停止推荐他们
2026-08-11
Suno 将为 AI 歌曲加水印并限制下载——德国败诉一周后
2026-08-08
阿里把语音模型打包成一个应用:会自己清理的转写,能变成播客的文档
2026-08-07
OpenAI 首款设备据称是甜甜圈形音箱——无屏幕、有活动部件、售价 300 美元以上
2026-08-07
字节跳动 SeedRealtime:边看、边听、边说,同时进行
2026-08-05
FLUX 3 Video 向所有人开放:自带声音的 20 秒视频片段
2026-08-05
MiniMax H3发布:自带立体声的2K视频生成,价格只有对手的三分之一
2026-08-01
ChatGPT的语音现在带有隐形水印——任何人都能检测
2026-08-01
慕尼黑判决:Suno输掉欧洲首起重大AI音乐版权案
2026-07-31
周五慕尼黑开庭:欧洲首个重大「AI音乐版权」判决
2026-07-28
在App中阅读——免费,9种语言