Google Lyria 3 Pro 评测(2026):音质、提示词、定价及 API

Google Lyria 3 Pro 评测(2026):价格、提示词与 API

18代付费用户 · 2026年8月

歌曲完整且有力。控制变化真实自然。.

18/18任务成功
55.5 秒中位数代际时间
$0.08按已测试的请求
17/18距离目标5秒内

经过18轮付费生成后,我们的Google Lyria 3 Pro评测发现,该模型能够生成一首包含人声、歌词、主歌、副歌、过渡段以及近三分钟编曲的完整歌曲。此外,其生成结果的确定性也低于那些经过精心打磨的演示作品所展示的水平。 虽然每次任务均成功完成,且所有输出均以 44.1 kHz、192 kbps 的立体声 MP3 格式呈现,但在重复提示的情况下,系统仍会出现遗漏合成器独奏、更改具体歌词、偏离指定风格,以及忽略“无主唱”和“无升调音效”等限制条件的情况。.

简短评价: Lyria 3 Pro 是一款功能强大的完整歌曲生成器,适合能够生成多个版本并从中挑选最佳版本的用户。它并非一款能一键生成精确歌词、精确段落时长或满足严格负面约束条件的工具。. 以每条完整歌曲的 $0.08 Gemini API 请求计算,该选曲工作流的成本尚可接受,但仍需进行试听和编辑质量保证。.

2026年Lyria 3 Pro的现状:Pro并非Lyria系列中的最新机型

截至2026年8月10日,, 谷歌DeepMind介绍Lyria 3.5 作为其最新一代音乐播放器,并通过Flow Music进行推广。但这并不意味着Lyria 3 Pro已经过时。.

"(《世界人权宣言》) 当前的 Google Cloud Lyria 3 模型页面 仍列出 Lyria 3 Pro 预览 在型号 ID 下 lyria-3-pro-预览版, ,支持整首歌曲生成、用户自填歌词、图片转音乐输入、结构控制,以及最长184秒的音频片段。.

命名很重要,因为这两个界面的操作方式不同。如果您特别想要体验最新的 Flow Music 功能,请使用 Lyria 3.5。 若您需要文档中记载的 Gemini Interactions API 或 Google Cloud 模型路径,请使用 Lyria 3 Pro Preview。本评测主要针对该 Pro 工作流,并使用了一条独立的 Broly Anywhere 测试路径来生成这 18 个样本。.

谷歌DeepMind页面介绍了Lyria 3.5,称其为最新的音乐生成模型
谷歌DeepMind将Lyria 3.5称为其最新的音乐生成模型。查阅于2026年8月10日。.

简评:Google Lyria 3 Pro 怎么样?

是的——前提是你将其视为一款潜力巨大的生成器,而非确定性的音乐渲染器。最出色的输出作品具有连贯的歌曲结构、令人信服的乐器组合、干净利落的结尾,以及足够的结构感,让人感觉是经过精心创作而非简单循环生成的。 长篇测试尤其具有参考价值:两个180秒的请求分别生成了时长为176.170秒和177.006秒的连贯曲目。.

这些缺陷体现在可重复性上。同一条乐器提示先生成了一段克制的科幻配乐,随后又生成了一首古典室内弦乐曲,其中遗漏了若干指定乐器。完全相同的歌词在第一次生成时效果完美,但在另外两次重复生成中却发生了变化。如果你的作品发布取决于某一句歌词、某个独奏段落或某个“禁忌元素”绝不能出现,请务必准备备选方案,并仔细检查每次生成的结果。.

最适合不太适合
曲风鲜明、情感脉络清晰的完整歌曲一气呵成地准确演唱歌词
长篇器乐曲和电影般的渐强段落无需DAW校验即可实现帧级精确的片段时间控制
起草多语言人声创意硬负约束
希望获得按首计费的简单 API 价格的开发者需要确定性再生功能的用户

若要进行更广泛的类别比较,现有的 ElevenLabs 与 Lyria 3 Pro 与 Mureka 音乐测试 这说明了为什么在音乐结构的完整性比单纯的声乐控制更为重要的情况下,Lyria才是最合适的选择。.

什么是 Lyria 3 Pro?

Lyria 3 Pro 是 Google 在 Lyria 3 API 系列中用于生成完整歌曲的音乐生成模型。. 谷歌于2026年3月25日发布了Lyria 3 Pro, ,该版本适用于时长不超过三分钟的曲目,可对前奏、主歌、副歌、过渡段、歌词、节奏和乐器编配进行控制。体积更小的 Lyria 3 Clip 型号专为固定时长 30 秒的输出而设计,而 Pro 型号则适用于完整的编曲。.

"(《世界人权宣言》) 最新的 Gemini 音乐生成指南 称这两款Lyria 3机型均支持接收文本和图像,并输出44.1 kHz立体声音频。.

"(《世界人权宣言》) Google Cloud Lyria 提示指南 支持更广泛的云端输入格式,包括 PDF 文件和最多 10 张参考图片。这些是特定平台的特性,因此请勿假设每种输入类型都能通过所有第三方渠道正常使用。.

谷歌公告称,Lyria 3 Pro 可生成最长三分钟的曲目,并具备结构控制功能
谷歌表示,单曲时长最长可达三分钟,并可对前奏、主歌、副歌和过渡段进行控制。.

我们如何测试 Lyria 3 Pro

该动手实践测试使用了 Broly Anywhere Tasks API 端点,其模型 ID 为 lyria-3-pro. 这是该用户授权的测试环境,并非 Gemini 的官方消费者界面。我们进行了 18 项测试任务,涵盖了相同提示词下的可重复性、自定义歌词、定时结构、乐器还原度、长篇内容连贯性、BPM/调性/乐器控制、西班牙语和日语人声,以及 API 生成内容。.

证据分为三个层面。文件和API相关数据——时长、MP3格式、采样率、比特率、声道数、任务耗时以及报告的成本——直接来源于系统响应和下载的音频文件。 通过 Gemini 3.6 Flash 音频处理流程生成了下文中使用的聆听描述和尽最大努力完成的歌词转录。这是一项基于模型的辅助聆听评估,而非人工评审小组或人工 MOS 评估。若精确的 BPM、调号和乐段时间戳未在数字音频工作站(DAW)中进行独立测量,则将其视为暂定值。.

测试指标测量结果
已完成的任务18/18
生成的音频总数1,858.195秒
文件交付MP3,44.1 kHz,192 kbps,立体声,18/18
生成时间46–75 秒;中位数为 55.5 秒
报告的场地费用每项任务 $0.08;总计 $1.44
持续时间精度17/18,距离目标不到五秒
平均绝对持续时间误差2.913秒

在任务已创建后,有两次网络读取操作失败。运行器恢复了这些现有任务的ID,而不是重新提交,因此该集合中仍然包含18个唯一的任务和18个唯一的输出。.

Lyria 3 Pro 实测评分表,展示了 18 次成功的 API 生成、音频规格、速度、成本、时长准确度以及控制故障情况
在测试环境中,共有18项Lyria 3 Pro任务取得成功;客观文件和API数据与模型辅助观察结果已分开记录。.

Lyria 3 Pro 的音质:音质细腻,操控体验参差不齐simplified

整体音乐表现力与混音

听感评估中,对表现最出色的作品一致评价为:制作精良、连贯流畅且混音出色。 T01中的合成器流行乐曲目保留了明亮的琶音合成器、电子鼓、吉他点缀、女声主唱以及充满希望的基调。T05中的两首后摇滚曲目保持了可辨识的长篇铺陈结构,而非沦为显而易见的短循环。.

这并不意味着所有要求的细节都得以保留。T01-R1 将要求的合成器主旋律融入了结尾部分,而非单独呈现一段独奏;而 T01-R3 则省略了独奏部分,且在高音区出现了细微的人声合成 artifacts。T01-R2 的还原效果最为纯净。.

T01-R2 — 最劲爆的合成器流行乐重播
来自“Broly Anywhere Tasks”活动现场的代表性作品。.

完全一致的歌词:有可能,但并非必然

自定义歌词测试是生成多个版本的最明显原因。T02-R1 省略了最后一段过渡段的大部分歌词。T02-R2 在副歌之后添加了回声重复。T02-R3 在“尽最大努力”的转录中完全遵循了提供的歌词文本。.

这一功能虽然实用,但会改变工作流程。不要仅仅因为第一段歌词正确就通过这首歌。在进入混音或发行阶段之前,请将完整的人声与源文本进行对比,包括重复的副歌和最后一句。.

T02-R1 — 歌词省略示例
来自“Broly Anywhere Tasks”活动现场的代表性作品。.
T02-R3 — exact-lyrics 候选版本
来自“Broly Anywhere Tasks”活动现场的代表性作品。.

结构与限时部分

这三首时长均为120秒的电影风格电子乐作品,据描述均遵循了要求的宏观结构顺序:经过滤波处理的引子、第一段主歌、宏大的副歌、大提琴/颗粒合成间奏、力度更强的第二段主歌、最终副歌,以及两和弦结尾。 实际文件时长为115.148至117.029秒,因此均未达到120秒的目标时长。.

在某些运行中,评估器还生成了超出实际文件时长的、不合理的时间戳。因此,其有价值的结论是有限的: Lyria 3 Pro 处理了所请求的序列,但此测试并不能证明片段定位达到了帧级精度。. 如果需要将副歌部分精确放置在某个特定的剪辑点上,请使用数字音频工作站(DAW)。.

仪器精度与最大的重复性失效

T04-R1 通过大提琴的持续音、持续音效、玻璃般的音色、受控的音高峰值以及未解决的结尾,成功呈现了预期的科幻悬疑氛围。T04-R2 虽然使用了相同的提示,但风格却偏向了古典室内乐弦乐。它缺少了弱音钢琴的脉动、模拟持续音效以及玻璃泛音。.

T04-R1 — 忠实于提示的乐器候选方案
来自“Broly Anywhere Tasks”活动现场的代表性作品。.
T04-R2 — 仪器风格漂移示例
来自“Broly Anywhere Tasks”活动现场的代表性作品。.

这一组示例比单个完美的演示更有用,因为它展现了实际制作中的风险。详细的提示可以提高成功率,但不会固定编曲方案。当乐器身份至关重要时,请生成至少两个版本。.

长篇连贯性

这两首三分钟的后摇滚曲目在整个发展过程中都保持了连贯性。T05-R1的时长为176.170秒,T05-R2为177.006秒,随后均回归到了开头的吉他主题。两份聆听报告均未指出存在突兀的风格转变或被截断的结尾。.

T05-R1 — 长篇后摇滚示例
来自“Broly Anywhere Tasks”活动现场的代表性作品。.

这正是 Pro 版名副其实之处。Lyria 3 Clip 适用于循环播放或短暂预览;而 Lyria 3 Pro 则能维持足够长的编曲时长,足以完成一首完整的歌曲初稿、预告片配乐或视频配乐。.

多语言人声

西班牙语和日语的样本均被描述为清晰易懂,且与提供的歌词非常接近。根据尽可能准确的转写结果来看,每场演绎都将最后一段副歌旋律转化为一个额外的音乐亮点。这虽是一种微小的艺术处理,但仍属于歌词的改动。.

T07B-R1 — 日本声优候选人
来自“Broly Anywhere Tasks”平台的代表性输出;建议由母语者进行审核。.

Google Cloud 将英语、德语、西班牙语、法语、印地语、日语、韩语和葡萄牙语列为支持的语言。仅凭一个西班牙语示例和一个日语示例,无法证明这八种语言的质量均等,因此由母语者进行审核仍是合理的发布把关环节。.

负约束可能会失败

T08 要求不包含人声、说话声、合唱、渐强音效或电影音效。但在试听评估中,最终作品中仍出现了短暂的人声片段和一段渐强音效,尽管作品主要呈现了 124 BPM 的极简科技舞曲风格,且结尾处理得干净利落。.

T08-R1 — 负约束失败示例
来自“Broly Anywhere Tasks”活动现场的代表性作品。.

Google Cloud 的模型页面明确指出,不支持负面提示。您仍然可以使用自然语言编写正面排除条件,但结果应被视为指导性建议,而非硬性过滤条件。.

包含11个具有代表性的Lyria 3 Pro输出结果的波形接触图,其中包括严格遵循提示、灵活变通以及未遵循提示的示例
典型输出包括成功的运行和出现矛盾的运行;波形仅显示振幅包络和相对长度。.

Lyria 3 Pro 提示词:效果最佳的公式

谷歌的提示词指南建议将曲风、氛围、乐器配置、节奏、人声和歌词结合起来。我们效果最佳的提示词还增加了两个维度:明确的乐段顺序和明确的结尾处理方式。.

适用于 Lyria 3 模型的官方 Google Cloud 提示词框架
谷歌推荐的 Lyria 提示词公式:曲风、氛围、乐器配置、节奏、人声和歌词。.

一个实用的 Lyria 3 Pro 提示词公式是:

  1. 长度与格式: “创作一首90秒的纯音乐曲目。”
  2. 类型与氛围: 请各列举一种主要风格和一种情感基调。.
  3. 速度、调号和拍号: 在关键情况下,请使用精确数值。.
  4. 乐器编制: 列出构成该编曲特色的声音。.
  5. 主唱与作词: 请指定声音类型、语言、发音风格和确切的文本内容。.
  6. 结构: 定义前奏、主歌、副歌、过渡段、独奏和尾奏。.
  7. 结尾: 请求“干净停顿”、“解决和弦”、“未解决和弦”或“淡出”。.

最常见的错误是提出过多的约束条件,并将其视为保证。T04和T08的失败案例说明了为什么在提示之后应进行筛选步骤,而不是直接进行盲目发布。.

考试中使用的确切题目

以下提示词正是本评测中讨论的运行所发送的原始文本。.

T01 — 基于相同提示的合成流行乐可重复性

使用的提示词

提示

创作一首制作精良的90秒英文合成器流行歌曲,节奏为112 BPM,4/4拍。氛围:经历艰难一夜后的充满希望。乐器配置:温暖的模拟合成器贝斯、明亮的琶音合成器、紧凑的电子鼓、清亮的电吉他点缀,以及一段简短的旋律性合成器独奏。 使用一位自然女声主唱,发音清晰。创作原创歌词,包含10秒前奏、第一段主歌、前副歌、令人难忘的副歌、第二段主歌、副歌重复段、简短的合成器独奏,以及干净利落的尾声。混音应保持开阔通透且适合电台播放;避免使用旁白和人群声。.

T02 — 完全定制的歌词

使用的提示词

提示

创作一首时长100秒、BPM为96的另类流行歌曲,包含亲密的钢琴声、弱音电吉他、柔和的贝斯、克制的鼓点,以及一条富有表现力的男主唱人声。请完全按照以下原创歌词演唱,保留各段落标签作为歌曲结构,但不要念出标签内容。 除书面标注的重复副歌外,不得添加、省略、重新排列或重复歌词行。

[第一段]
走廊里的钟慢了五分钟
湛蓝的清晨在门下静候
我收起了那张我们从未用过的地图
并在二楼留了一盏灯

[副歌]
若今夜道路遗忘了我们的名字
顺着河流走,顺着光芒走
我会在桥弯处等待
紧握那段我们未能终结的音符

[第二段]
一轮纸月亮掠过仪表盘的玻璃
城市在银色的雨中消融
我在收音机的嘶嘶声中听见你的声音
随后又调频穿过寂静

[副歌]
如果今夜道路遗忘了我们的名字
就顺着河流走,顺着光芒走
我会在桥弯处等你
握着那张我们未能写完的纸条

[间奏]
没有最后一句话,没有结束的标志
只有你那小小的指南针紧挨着我的

间奏结束后,以一段简短的器乐段落收尾。.

T03 — 定时结构控制

使用的提示词

提示

创作一首时长120秒、调性为E小调、BPM为100的电影风格电子乐曲,并尽可能严格遵循以下时间线:0:00-0:10 为经过滤波处理的合成器音色与遥远的脉冲声组成的前奏; 0:10-0:35 低音女声主歌段,配以稀疏的底鼓;0:35-0:55 宽广的副歌段,配以完整的鼓组和层次丰富的和声;0:55-1:15 以大提琴和颗粒合成器为主导的器乐间奏;1:15-1:38 第二段主歌,低音更强劲; 1:38-1:55 最终副歌;1:55-2:00 干脆利落的双和弦结尾,不带淡出效果。英文原版歌词应描述在日出前穿越一座城市的场景。请勿包含音乐之外的说话声或杂音。.

T04 — 乐器还原度

使用的提示词

提示

创作一段90秒的纯器乐电影配乐,绝对不能包含人声、低语、吟唱、对话或合唱。风格:72 BPM的克制型科幻悬疑风格。 乐器配置:低音大提琴的固定音型、带弱音器的钢琴脉冲音、柔和的模拟持续音、刷奏的框鼓,以及偶尔出现的玻璃泛音。从简约的开头逐渐铺陈,在1分05秒处达到一个受控的高潮,随后以一个清晰且未解决的和弦结束,无需淡出。保持声学深度的连贯性,并确保低频部分干净利落。.

T05 — 长篇连贯性

使用的提示词

提示

创作一首完整的180秒后摇滚器乐曲,调式为D小调,拍号6/8,BPM约为84。 以指弹电吉他和环境混响开场,30秒后引入贝斯和通鼓,70秒后加入克制的弦乐四重奏,在2分05秒至2分35秒之间达到主要渐强高潮,随后回归开头的吉他主题,并在3分00秒前干净利落地收尾。 不得包含人声、合唱、语音或音效。整首作品中需保留一个可辨识的四音符主题,并避免突兀的风格转变、循环痕迹或断续的结尾。.

T06 — BPM、调号、拍号和独奏节奏

使用的提示词

提示

创作一首时长100秒、调性为升F小调、节奏为4/4拍、BPM精确为92的器乐新灵魂乐(neo-soul)律动曲。使用罗德斯电钢琴、指弹电贝斯、干音鼓边击打声、弱音节奏吉他,以及一段从大约0:55到1:15的次中音萨克斯独奏。 和声应以F#小调为主,适度运用切分节奏,不包含人声和合唱,结尾处应采用乐队刻意停奏而非淡出。.

T07A — 西班牙语人声

使用的提示词

提示

创作一首90秒的西班牙语原声流行歌曲,节奏为104 BPM,使用尼龙弦吉他、立式低音提琴、手鼓、柔和的钢琴伴奏,以及一位自然风格的女主唱。请清晰地演唱以下原创歌词,切勿翻译:[主歌] 在城市的灯光之间,我珍藏着一张纸质地图。 每条街道又开始诉说,每个影子都知道是谁。[副歌] 顺着河流一直流向大海,把恐惧留在车站。如果黑夜再次降临,我会点燃另一首歌。副歌重复一次,加入一段简短的吉他间奏,并以干净利落的方式收尾,不要加入旁白。.

T07B — 日语人声

使用的提示词

提示

创作一首90秒的日语梦幻流行歌曲,节奏为108 BPM,包含清亮电吉他、温暖的合成器垫音、旋律性贝斯、轻盈的电子鼓,以及一位自然风格的女主唱。 请清晰地演唱以下原创歌词,切勿翻译:[主歌] 在破晓前的车站,等待着静谧的风。在遗忘的地图上,蓝光摇曳。 [副歌] 跨越河流,走向无名的明天。怀揣着一首小歌,再次启程。副歌重复一次,加入一段简短的器乐过渡段,并以干净利落的结尾收尾,不要加入旁白。.

T08 — API 构建产物和负约束测试

使用的提示词

提示

创作一首时长60秒、BPM为124、调式为A小调的纯器乐极简科技舞曲,包含干声底鼓、紧凑的闭合踩镲、圆润的单声道贝斯、一个金属质感的打击乐主题,以及一个逐渐展开的滤波合成器音色。不得包含人声、语音、合唱、升调音效或电影音效。 请刻意保持编曲的简约风格,并以干净利落的一拍停顿收尾,以便检查返回的时长、格式、采样率、比特率、声道数、元数据块以及结尾处理方式。.

Lyria 3 Pro 售价

谷歌的 Gemini 开发者 API 定价页面 列出了 Lyria 3 Pro 预览版,地址为 每首完整歌曲点播 $0.08 以及《Lyria 3》预告片预览,请见 每首30秒的歌曲为$0.04. 两种 Lyria 模型均不提供 Gemini API 免费配额。计费方式按请求次数计算,而非按令牌数量计算。.

Lyria 3 Clip 和 Lyria 3 Pro 预览版的 Gemini API 定价
2026年8月10日核查的Gemini API官方价格。.

路线

Gemini 开发者 API

型号/产品

lyria-3-pro-预览版

评测机型

公布价格

每首完整歌曲 $0.08

重要限制

无免费套餐;预览模式

路线

Gemini 开发者 API

型号/产品

lyria-3-clip-preview

公布价格

每首30秒的歌曲为$0.04

重要限制

已修复简短角色描述

路线

谷歌云

型号/产品

Lyria 3 Pro 预览

公布价格

查看Lyria的最新价格

重要限制

适用预览条款和配额限制简体中文(大陆)

路线

Gemini 消费类产品

型号/产品

Lyria 音乐创作

公布价格

订阅访问权限因套餐/地区而异

重要限制

与 API 的计费路径不同

路线

已测试“布罗利无处不在”路线

型号/产品

lyria-3-pro

公布价格

API响应显示上游成本为$0.08

重要限制

仅限特定场地的活动,并非零售承诺

对于订阅上下文,请从当前的开始 Google AI Plus 评测及其隐藏的局限性.

"(《世界人权宣言》) Google AI Plus 与 Pro 套餐对比 将容易与 API 访问混淆的套餐限制区分开来。.

如需仅查询价格,请参阅当前的 Google AI Plus 订阅价格.

区域访问情况可能会发生变化;该 Google AI Plus 在美国的上市情况及价格评测 解释了为什么不应将消费者订阅视为通用 API 访问权限。.

如果价格是决定性因素,那么简单的计算结果颇具吸引力:10 Pro 代的费用为 $0.80(不含税及平台调整费)。隐藏的成本在于内容筛选时间。即使 API 本身价格低廉,要获得准确的歌词或乐器编曲,也可能需要多次输出。.

Lyria 3 Pro API:模型 ID、请求和输出

对于官方的 Gemini 路线,请使用 Gemini Interactions API 音乐工作流 带型号 ID lyria-3-pro-预览版. 该响应为生成的音频和文本提供了便捷属性。音频采用 base64 编码;文本可包含歌词或结构信息。.

Vertex AI Lyria 3 Pro 技术规格与语言支持
Vertex AI 的 Lyria 3 Pro 预览版规格,包括以 44.1 kHz 采样率输出的 184 秒 MP3 音频。.

基于谷歌当前文档的 Python 示例

PYTHON

import base64
from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="lyria-3-pro-preview",
    input=(
 "一首时长90秒、调式为E小调的电影风格电子乐曲。 "
 "以经过滤波处理的脉冲声开场,逐渐发展为宽广的副歌,"
 "加入一段由大提琴主导的器乐间奏,结尾不淡出。"
    ),
)

generated_audio = interaction.output_audio
if generated_audio:
    with open("lyria-song.mp3", "wb") as file:
 file.write(base64.b64decode(generated_audio.data))

歌词或结构 = interaction.output_text
如果 歌词或结构:
    print(歌词或结构)

谷歌的指南指出,MP3 是默认格式。该指南还说明了 response_format={"type": "audio"} 用于请求符合该 Interactions API 流程所支持格式的专业音频输出,包括其文档中记载的 WAV 选项。Google Cloud 当前的模型页面所列格式范围较窄:仅列出了 MP3、44.1 kHz 和 192 kbps。在描述格式时,应明确列出具体格式名称,而非仅提供一个通用规格。.

经过测试的 Anywhere 路线同样采用异步处理,但其任务架构因场所而异。该接口返回了任务 ID、状态、进度、音频 URL、时间戳、提供商和费用等字段。请勿将该响应结构直接粘贴到 Gemini 代码中,并将其视为 Google 的官方架构。.

Lyria 3 Pro 与 Lyria 3 Clip 与 Lyria 3.5 对比

模型最佳用途长度2026年8月的职位空缺
《Lyria 3》预告片循环音频、预览、短视频配乐30 秒Gemini API 预览;$0.04/请求
Lyria 3 Pro 预览完整的歌曲、歌词、副歌、过渡段在 Google Cloud 上最多 184 秒Gemini/Google Cloud 预览版;$0.08/请求
Lyria 3.5最新一代音质与Flow音乐创作在当前 DeepMind 定位中最多三分钟通过 Flow Music 推广;此处使用的并非该 API 测试中使用的模型 ID

当速度和短格式输出至关重要时,请选择“Clip”模式。当您需要通过文档中所述的 API 生成完整歌曲时,请选择“Pro”模式。当最新的 Flow Music 体验比使用 Pro API 中的模型 ID 更为重要时,请选择“Lyria 3.5”模式。.

Lyria 的适用范围也比通用音频模型更窄。如果某个项目需要在同一个生成的场景中混合对话、音效、环境音和音乐,那么 Seed Audio 1.0 语音、音效和音乐评测 涵盖了这一不同的工作流程。.

关于视频制作,请阅读以下内容 Veo 3.1 处理声音和背景音频.

当语音表现和同步是更棘手的问题时,请采用实用的 Veo 3.1 对话、音频和口型同步工作流程.

安全性、SynthID、商业用途及限制

谷歌表示,Lyria 3 的输出包含 SynthID 水印。该 当前的 Google Cloud 规格 此外还列出了内容凭证(C2PA)、输入过滤、输出朗读过滤以及语音相似度过滤。这些控制措施有助于确保来源可追溯性和安全性;但它们并不能免除您为自己的项目获取歌词、参考图像、采样、肖像权及分发权的必要性。.

Lyria 3 音乐生成功能的官方 Gemini API 限制
谷歌在文档中介绍了安全过滤器、SynthID、单轮生成、持续时间变异性以及非确定性。.

Google Cloud 将 Lyria 3 Pro 归类为生成式 AI 预览版服务。其页面说明指出,客户可选择将该预览版用于生产或商业用途,并向第三方披露生成的内容,但须遵守正式发布前条款及相关访问协议。这并不等同于无条件承诺每首生成的曲目均无风险或具有独家性。.

实际限制很简单:

  • 预览版模型在正式发布前可能会发生变化。.
  • Gemini API 的定价方案中,Lyria 3 没有免费额度。.
  • 在当前的 Google Cloud 模型页面上,一个提示词会返回一个音频片段。.
  • 系统不支持“负面提示”作为一项正式功能。.
  • 当前的 Gemini 音乐生成功能采用单轮生成模式,而非就地多轮编辑器。.
  • 持续时间和是否能及时遵从治疗情况各不相同。.
  • 精确的歌词、BPM、调号和时间戳仍需进行输出层面的质量检查。.

哪些人适合使用 Lyria 3 Pro?

如果您是开发者、电影制作人、游戏创作者、作曲家或内容团队,希望通过 API 获取完整的音乐创意并能筛选多个候选方案,请使用 Lyria 3 Pro。该工具在电影配乐、流行歌曲结构、长篇器乐段落以及多语言人声演示方面表现尤为出色。.

如果你需要确定性的音节、生成后的精确编辑、有保障的负面约束,或者希望通过一次请求就获得最终母带处理版本,那么请跳过它——或者在手边备好另一款工具。Lyria 3 Pro 更擅长生成出色的音轨,而非像 DAW 的自动化轨道那样严格遵守每一条指令。.

GlobalGPT 的 基于浏览器的音频工具 虽然该平台可在同一处支持相关的语音识别和转录工作,但该公共页面与本文测试的 Lyria API 属于不同的产品界面。本评测并未声称该页面是经过验证的 Lyria 3 Pro 解决方案。.

Google Lyria 3 Pro 常见问题解答

Lyria 3 Pro 是谷歌最新推出的音乐机型吗?

不。截至2026年8月10日,谷歌DeepMind将Lyria 3.5称为其最新的音乐生成模型,并通过Flow Music进行推广。Lyria 3 Pro仍是Gemini和Google Cloud开发者通道下已记录的完整歌曲预览模型,具体详见 lyria-3-pro-预览版.

Lyria 3 Pro 的售价是多少?

Gemini 开发者 API 显示,Lyria 3 Pro 预览版每条完整歌曲请求的费用为 $0.08。Lyria 3 片段预览版每 30 秒歌曲的费用为 $0.04。 这两种模型均不提供 Gemini API 的免费额度,且面向消费者的订阅服务采用不同的套餐和区域规则。.

Lyria 3 Pro 支持的歌曲最长时长是多少?

谷歌的公开说明称最长为三分钟。当前的谷歌云技术页面给出的音频片段最长时长为184秒。在我们进行的两次180秒测试中,生成的MP3文件时长分别为176.170秒和177.006秒。.

Lyria 3 Pro 能准确演唱自定义歌词吗?

是的,但并非必然如此。在三次重复的自定义歌词版本中,其中一次与听写稿中的文本完全一致;另一次省略了最后一段过渡段落的大部分内容;第三次则添加了回声重复效果。请务必将完整的演唱内容与原始歌词进行对比。.

Lyria 3 Pro 能生成没有演唱的纯器乐音乐吗?

是的,但书面排除条款并非绝对保证。在一项乐器测试中,生成的音乐完全不含人声;而在另一项“极简科技”风格的约束测试中,尽管标注了“无人声”,生成的音乐中却出现了人声切片。此外,谷歌云在当前模型页面上也将负面提示标记为“不支持”。.

Lyria 3 Pro 的 API 模型 ID 是多少?

Gemini 的官方型号及 Google Cloud 模型 ID 为 lyria-3-pro-预览版. 本文评测中的实机体验环境使用了第三方路线 ID lyria-3-pro; 其任务模式和命名不应替代 Google 的官方 Interactions API。.

Lyria 3 Pro 生成的文件格式是什么?

谷歌的 Gemini 指南指出 MP3 是默认格式,并在 Interactions API 中记录了 Pro 输出格式选项。 Google Cloud 列出了 44.1 kHz、192 kbps 的 MP3 格式。我们测试路径中的全部 18 个文件均符合该 44.1 kHz、192 kbps 立体声 MP3 规格。.

Lyria 3 Pro 可以用于商业用途吗?

Google Cloud 表示,客户可选择将此预览版服务用于生产或商业用途,并公开生成的内容,但须遵守其“正式发布前”条款及访问协议。请仔细阅读相关条款,并在发布前清除其中包含的任何歌词、肖像、采样或参考媒体。.

我可以在 GlobalGPT 上使用 Lyria 3 Pro 吗?

本评测并未声称已验证GlobalGPT Lyria的公开路线。 这18个实操示例均通过Broly Anywhere Tasks API运行,而GlobalGPT的公开音频页面目前提供了一个独立的语音和转录工作区。如需使用已记录的官方API路径,请使用Gemini或Google Cloud。.

最终判决

Google Lyria 3 Pro 是一款值得信赖的完整歌曲 API 模型,其单次请求价格低廉,输出内容连贯且篇幅较长,并具备异常精细的提示词控制功能。18 次测试还揭示了发布演示中未展示的部分:结构细节、精确歌词、乐器名称以及负面约束条件,这些内容在完全相同的请求之间可能会发生变化。.

当你能生成两到三个候选版本、对比整首歌曲并保留最出色的版本时,这种权衡是可以接受的。对于这种工作流程,Lyria 3 Pro 非常值得推荐。但若要实现确定性的歌词输出,或通过单次请求获得可直接编辑的精准结果,仍需人工审核和数字音频工作站(DAW)的配合。.

分享帖子:

相关帖子