“乐器声听起来宛如真实演奏,整首曲子从头到尾稳定不散。”
ElevenLabs 推出了全新音乐模型 Music v2.5。
大家好,我们是 Sonetho。⚡
2026年9月11日,ElevenLabs 宣布推出 Music v2.5。
这是继5月底推出 Music v2 之后,时隔约三个半月的更新。
本文仅整理官方公告与技术文档中写明的事实。
文中不包含我们自行制作的对比测试结果。待我们亲自用耳朵鉴别确认后,再另行向大家分享。
🎧 迎来哪些改变
1. 声音更加厚实
官方的具体说明是:乐器声更加贴近真实演奏,曲目的层次感与动态起伏更丰富,且能够自始至终稳定维持。
官方公告中还使用了“编曲深度有所增加”这一表述。
2. 盲测对比全面领先 v2
ElevenLabs 进行了 47,885 组的双盲对比测试,并表示在绝大多数样本中,测试者都选择了 v2.5。
不过官方并未公开具体的百分比,我们也不会在此主观推测具体数字。
3. 特定曲风提升幅度尤为显著
官方公告特别指出,提升最明显的是以人声为主或原声乐器占比较高的流派。
官方明确提及的风格包括:R&B、灵魂乐、嘻哈、摇滚、金属、管弦乐以及影视配乐(Cinematic)。
反过来说,如果是以电子音色为主的曲子,实际听感差异可能并不明显。
💾 免费套餐也开放了无损格式下载
这是本次更新中最显眼的一项变化。
免费套餐:每天 5 次无损格式下载
Pro 套餐:每月 400 次无损格式下载
需要注意的是,凡是引用其他音乐人的音频所生成的曲目,均不支持下载。
在使用参考音频功能时务必提前了解这一点,以免白费功夫。
📍 可以在哪些平台使用
Music v2.5 已支持在以下所有入口使用:
ElevenMusic(音乐专用界面)
ElevenCreative(综合订阅)
Studio(视频配乐)
Flows(节点流连接)
API
原有的 Music v2 并不会下线。官方表述为“它哪儿也不会去”。
如果您习惯了 v2 的声音,依然可以继续使用。
⚙️ 如果使用 API 调用,请注意这一点
在网页界面使用时无需操心,但通过 API 调用时情况有所不同。
API 文档中明确标注,model_id 的默认值依然是 music_v1。
当前可选的值共有三个:music_v1、music_v2 以及 music_v2_5。
有趣的是,在同一份官方文档的模型列表中,ElevenLabs 明确将 music_v1 标注为“outclassed”,即已被 v2 和 v2.5 全面超越的落后模型。
也就是说:如果调用 API 时不填写模型名称,系统默认调用的反而是官方自认落后的旧模型。
如果您想通过 API 调用 v2.5,请务必在 model_id 中填入 music_v2_5。仅一行代码之差。
曲目生成时长支持 最短 3 秒至最长 5 分钟,参考音频最多可上传 约 30 秒。
输出格式提供 MP3(44.1kHz)和 WAV 两种。
💼 生成内容是否可以商用
ElevenLabs 说明,生成的音乐可用于视频、广告、播客、游戏等绝大多数商业场景。
但有一点必须遵守:使用免费套餐制作的曲目必须注明署名。
服务条款中写明的文字为 “Created in collaboration with ElevenLabs”,
也可以使用经 ElevenLabs 认可的其他表述。
还有一项令人欣慰的条款:
即使后续降低套餐等级或取消订阅,此前已生成曲目的商用权益依然有效。
相对地,官方也明确列出了提示词中绝对禁止输入的内容:
歌手、作曲家的真实姓名或艺名(无论健在与否)
歌曲名称、专辑名称、唱片公司或发行方名称
特定歌曲的大部分歌词
刻意模仿特定歌手的声音或风格特征同样在禁止之列。
由于针对流媒体发行等不同用途,各套餐的权益限制有所区别,
若您有正式发行的打算,建议提前查阅条款中的权益表格。
✍️ 总结
这次更新用一句话总结就是:
声音更厚实了,免费套餐也能直接下载无损音频了。
如果您制作的是包含人声或原声乐器的曲子,不妨用相同的提示词在 v2.5 上重新生成试听一下。
如果是以电子音效为主的曲目,差异可能不会太大。
正如当初测试 v2 时一样,我们接下来会用相同的歌词,对 v2 和 v2.5 进行实际对比。
用耳朵是否能听出差异、若有差异又体现在哪里,我们将在下一篇文章中与大家分享。
感谢您的阅读。⚡