2026年,AI音乐生成技术发展迅猛,但仅凭一段制作精良的演示作品,并不能让你知道哪个模型最适合处理你的歌曲。 本次对比测试将ElevenLabs Music v2、Google Lyria 3 Pro和Mureka v9置于相同的三个创作任务中:一首流行人声歌曲、一首电影风格的器乐曲,以及一项结构控制挑战。.
这三款音乐机型均可通过 GlobalGPT的多模型平台. GPT 曾一次性生成过这两组原始歌词,我们在各个音乐模型中均未对其进行修改。结果按性能和效率两部分进行分类,以避免将音乐质量与请求成本或生成时间混为一谈。.
简答:三种模型的表现如何
- 性能: ElevenLabs 负责歌词和结构的把控;Lyria 最符合电影化的创作要求。.
- 效率: ElevenLabs的速度最快,而Mureka的任务报告电量最低,输出时间最长。.

型号概述:ElevenLabs Music v2、Google Lyria 3 Pro 和 Mureka v9
| 模型 | 开发人员 | 产品聚焦 | 与本次比较相关的格式 | 官方产品页面 |
|---|---|---|---|---|
| ElevenLabs Music v2 | ElevenLabs | 基于文本的音乐创作与完整歌曲生成 | 带有演唱或纯器乐演奏的音乐 | ElevenLabs 音乐 |
| Google Lyria 3 Pro | 谷歌 DeepMind | 根据书面创意指导生成音乐 | 通过一个提示输入声乐和器乐的简要说明 | 谷歌 DeepMind Lyria |
| Mureka v9 | 穆雷卡 | AI歌曲创作与背景音乐生成 | 在已测试的 API 中,将歌曲路线与背景音乐路线分开 | 穆雷卡 |
上述产品系列描述来自开发者的公开产品页面。本文中使用的确切请求字段来自 2026 年 8 月 5 日查阅的 Broly API 架构。.
什么是 ElevenLabs Music v2?
- 根据书面要求生成完整的音乐作品。.
- 该测试路线支持在单个提示中同时提供创意方向和歌词。.
- 独特的测试控制: 明确的时长和纯器乐编曲。.

什么是 Google Lyria 3 Pro?
- 本次对比中选用的质量更高的Lyria 3路线。.
- 所测试的模式接受一个组合音乐提示。.
- 控制挑战: 该路线中没有单独的歌词、风格或时长字段。.

什么是 Mureka v9?
- 采用独立的“歌曲”和“背景音乐”路线。.
- 歌曲点播需将准确的歌词与风格指导分开。.
- 所走路线: 测试2的背景音乐;测试1和3的歌曲。.

基于相同提示词的音乐测试
我们的测试方法: 这三个模型的创建要求完全相同,只是每个 API 的字段映射有所不同。.
- 共享输入: 来自《GlobalGPT》的完全相同的简介和完全相同的由GPT撰写的歌词。.
- 持续时间 每个简报的目标时长为90秒;只有ElevenLabs提供了时长字段。.
- 效率: 从提交到终止状态所用时间,包括轮询和网络时间。.
- 试听评测: 编辑注释已与两轮 Gemini 3.6 Flash 音频分析结果进行交叉核对;已排除不可靠的精确时间戳。.
测试 01带人声的当代流行歌曲
任务设置: 创作一首当代合成器流行歌曲,讲述两个人深夜离开城市,走向充满未知未来的旅程。评分重点在于人声的自然度、歌词的完整性、副歌的清晰度、编曲,以及情感张力是否能贯穿至副歌部分。.
- 在各项检查中,ElevenLabs和Lyria的歌词均未出现明显的偏差。.
- ElevenLabs 在保持这种一致性的同时,还实现了最清晰的人声与乐器分离效果。.
- Mureka 的发音虽然独特,但其盲转录本指出了可能的替代词。.
ElevenLabs Music v2
测试输出
- 歌词没有明显的偏差 已检测到。.
- 具有电子合成器流行乐风格,前奏十分醒目。.
- 人声与乐器分离清晰。.
Google Lyria 3 Pro
测试输出
- 歌词没有明显的偏差 已检测到。.
- 气势恢宏、宛如主题曲般的旋律,人声随即加入。.
- 结尾部分很精彩,但结局却戛然而止。.
Mureka v9
测试输出
- 盲听转录标记为 a 可能的歌词替换.
- 具有鲜明的电子乐风格,带有新迪斯科的特色。.
- 延长版的器乐尾声让整首曲子变得更长了。.
测试 02电影配乐
任务设置: 创作一段具有清晰叙事弧线的电影配乐,而非简单的静态循环。评审将重点关注主题发展、配器、力度控制、过渡处理,以及最后一段是否名副其实地展现出宏大的气势。.
- 莉里亚保留了钢琴主题、渐进式的层次堆叠、后半段的铜管乐器以及圆满的结尾。.
- ElevenLabs 紧贴弧线飞行,但撞击时间比要求的时间要早。.
- 穆雷卡呈现了一首极具感染力且别具一格的作品,其类似人声的质感突破了创作要求。.
ElevenLabs Music v2
测试输出
- 没有声音质感 已检测到。.
- 令人耳熟能详的钢琴主题和循序渐进的铺陈。.
- 早期出现的影响削弱了对严格合规的要求。.
Google Lyria 3 Pro
测试输出
- 最佳匹配 用于主题、层次、后段铜管和高潮。.
- 未检测到语音质感。.
- 自然的动作和一个圆满的结局。.
Mureka v9 背景音乐
测试输出
- 类似人声的“啊”音色 违反了“不得发言”的规定。.
- 以小提琴为主导的、哀婉的开场逐渐发展成后半段的高潮。.
- 风格独特,但替换了几个被要求修改的元素。.
测试 03歌曲结构与提示控制
任务设置: 创作一首另类流行歌曲,讲述修理一台旧收音机,并在杂音中听到遥远回应的故事。歌曲结构顺序应为:前奏、主歌、前副歌、副歌、器乐间奏、过渡段、终结副歌和尾奏。评分重点在于结构规范性、歌词完整性、各段落间的对比以及结尾处理。.
- ElevenLabs 使得这八个指定部分最容易识别。.
- Lyria 虽然营造出了良好的段落对比,但修改了更多给定的词语。.
- 穆雷卡保持了流畅的节奏感,但间奏和尾声部分则稍显平淡。.
ElevenLabs Music v2
测试输出
- 最为清晰的八部分结构 在测试中。.
- 桥段与最后一段副歌的对比非常鲜明。.
- 球路偏长;结束时更像是逐渐减速。.
Google Lyria 3 Pro
测试输出
- 八拍的节奏流畅,间奏时长接近八秒。.
- 桥段与最终副歌之间的对比非常鲜明。.
- 盲听转录标记 修改了早期的歌词.
Mureka v9
测试输出
- 清晰抓耳的人声旋律,以及制作精良的流行放克风格。.
- 各部分之间的对比度较弱 过渡段和尾声。.
- 延长的吉他尾奏部分带来了最大的剪辑负担。.
测试结果揭示了各项能力的情况
提供的词汇最为连贯,且八部分结构最为清晰。.
与所要求的主题、层次、黄铜乐段和结尾最相符的作品。.
这些作品在风格上最为独立,但编辑工作量也最大。.
基于三个提示词的任务级研究结果——并非通用模型排名或语音准确率基准测试。.
发电效率
- 全套测试包
9 个可用输出(共 9 个) - 任务报告的总费用
$1.05 · 不重跑音乐任务
每个条形组都采用各自的计费标准。费用基于2026年8月5日完成的布罗利任务响应计算——而非官方服务商的定价或GlobalGPT积分。本地时间包含轮询和网络延迟。.
GlobalGPT内部三款型号的对比
GlobalGPT 将歌词创作和音乐生成两个阶段整合到一个多模型平台中:
- 一个可供比较的地方: ElevenLabs Music v2、Google Lyria 3 Pro、Mureka v9 和 GPT。.
- 共享的测试输入: 相同的创作要求、歌词和评判标准。.
- 公平场地测绘: 每个简报都会被转换为其模型路由实际支持的字段。.
常见问题
2026年最好的AI音乐生成器是哪一款?
在这三个提示中,没有一个模型能全面胜出。在本测试包中,ElevenLabs 在歌词和结构控制方面表现最强;Lyria 最贴近“电影配乐”的创作要求;而 Mureka 则产生了任务报告中能量值最低、篇幅最长且风格最为独立的输出内容。.
这些AI音乐生成器能同时生成人声和伴奏吗?
是的,但处理路径不同。ElevenLabs Music v2 支持人声和器乐的请求,Lyria 3 Pro 通过一个提示语即可接收这两类请求,而 Mureka v9 在本次测试中则分别采用了歌曲和背景音乐的处理路径。.
每个模型都收到了相同的提示词吗?
创意简报和歌词内容完全相同,但请求负载却不一致。由于 ElevenLabs、Lyria 和 Mureka 公开的 schema 各不相同,因此我们将共同的指令映射到各 API 的必填字段中。.
这些歌曲的长度完全一样吗?
ElevenLabs在全部三次测试中均返回了90.0秒,Lyria返回了84.0至89.5秒,而Mureka返回了167.1至183.9秒。只有经过测试的ElevenLabs路由暴露了持续时间字段。.
所列出的请求费用与订阅价格相同吗?
不。效率部分所显示的数值基于每次完成的Broly任务响应所产生的费用。该数值并不代表官方服务提供商的订阅、官方服务提供商的API费率,也不代表从GlobalGPT积分转换而来的数值。.
我可以将AI生成的音乐用于商业用途吗?
商业使用权取决于具体服务、账户、套餐、输出内容及当前条款。请查阅您项目所适用的服务提供商和平台条款;此创意测试并不构成法律许可。.
这三款机型在GlobalGPT中都有吗?
是的。通过 GlobalGPT,用户可以使用 ElevenLabs Music v2、Google Lyria 3 Pro 和 Mureka v9,从而在一个平台上访问多种音乐模型。.
最终结论
- ElevenLabs Music v2:最强大的操控性平均运行速度最快、输出结果精确到90秒、歌词一致性最佳,以及固定结构最清晰。权衡:任务报告的电量消耗最高。.
- Google Lyria 3 Pro:最出色的影院级体验器乐部分的对齐效果最佳,时长也最接近目标值。取舍:测试1的结尾过于突兀,测试3的歌词有所改动。.
- Mureka v9:最独立的解读具有鲜明特色的长篇作品,且客户反馈的收费最低。取舍:在严格的创作要求下,产出内容最长,但编辑工作量最大。.



