18세대 유료 구독 · 2026년 8월
강렬한 완성도 높은 곡들. 진정한 표현의 폭.
18세대의 유료 생성 과정을 거친 후, Google Lyria 3 Pro 리뷰 결과 이 모델이 보컬, 가사, 절, 코러스, 브릿지, 그리고 3분에 가까운 편곡이 포함된 완성도 높은 곡을 생성할 수 있는 것으로 나타났습니다. 또한, 세련된 데모가 시사하는 것보다 결과의 예측 가능성이 낮았습니다. 모든 작업은 성공적으로 수행되었으며, 모든 결과물은 44.1kHz, 192kbps 스테레오 MP3 형식으로 제공되었지만, 프롬프트를 반복해서 입력했음에도 신스 솔로가 누락되거나 정확한 가사가 변경되거나, 잘못된 스타일로 치우치거나, “보컬 없음” 및 “라이저 없음”과 같은 제약 조건이 무시되는 경우가 있었습니다.
간단한 결론: Lyria 3 Pro는 여러 버전의 가사를 생성한 뒤 그중 가장 좋은 것을 선택할 수 있는 사용자를 위한 강력한 전체 곡 생성 도구입니다. 이 도구는 정확한 가사, 정확한 구간 타이밍, 또는 엄격한 부정적 제약 조건을 충족시키는 원클릭 도구가 아닙니다. 전체 곡당 $0.08의 Gemini API 요청 비용으로 볼 때, 해당 선곡 워크플로는 비용 면에서 합리적이지만, 여전히 청취 및 편집 품질 관리(QA)가 필요합니다.

2026년 Lyria 3 Pro 현황: Pro는 Lyria의 최신 모델이 아닙니다
2026년 8월 10일 현재, 구글 딥마인드, ‘Lyria 3.5’ 소개 이 회사의 최신 음악 재생 기종으로, ‘Flow Music’을 통해 홍보하고 있습니다. 그렇다고 해서 Lyria 3 Pro가 구형이 되는 것은 아닙니다.
그리고 현재 Google Cloud Lyria 3 모델 페이지 여전히 나열되어 있다 Lyria 3 Pro 미리 보기 모델 ID 아래에서 lyria-3-pro-미리보기, 전체 곡 생성, 사용자가 제공한 가사, 이미지 기반 음악 생성, 구조 제어 기능, 최대 184초 길이의 클립 등을 지원합니다.
표면이 다르기 때문에 명칭을 구분하는 것이 중요합니다. 최신 Flow Music 경험을 특별히 원할 때는 Lyria 3.5를 사용하세요. 문서화된 Gemini Interactions API나 Google Cloud 모델 경로가 필요한 경우에는 Lyria 3 Pro Preview를 사용하십시오. 이 리뷰는 해당 Pro 워크플로우에 관한 것이며, 18개의 샘플을 생성하는 데는 별도의 Broly Anywhere 테스트 경로가 사용되었습니다.

간단한 평가: 구글 리리아 3 프로는 괜찮은가요?
네—단, 이를 결정론적인 음악 재생기라기보다는 잠재력이 큰 생성기로 평가한다면 말이죠. 가장 뛰어난 결과물들은 일관된 곡의 흐름, 설득력 있는 악기 조합, 깔끔한 마무리, 그리고 단순한 루프가 아닌 작곡된 곡처럼 느껴질 만큼 충분한 구조를 갖추고 있었습니다. 장시간 테스트는 특히 유용했습니다. 180초 요청 두 건 모두 176.170초와 177.006초 길이의 일관된 트랙을 생성해냈습니다.
이러한 취약점은 재현성 측면에서 드러났습니다. 똑같은 악기 지시문을 입력했을 때, 한 번은 절제된 느낌의 공상과학 음악이 나왔지만, 다음 번에는 요청된 악기 몇 가지가 빠진 클래식 실내 현악곡이 나왔습니다. 정확한 가사를 입력했을 때는 한 번은 완벽하게 재현되었지만, 나머지 두 번의 반복에서는 결과가 달라졌습니다. 만약 음반 발매가 특정 대사 한 줄, 솔로 한 부분, 또는 금지된 요소 하나가 절대 나타나지 않는 것에 달려 있다면, 대체안을 마련하고 모든 결과물을 꼼꼼히 검토할 계획을 세워야 합니다.
| 최상의 대상 | 다음과 같은 경우에는 적합하지 않습니다. |
|---|---|
| 장르가 명확하고 감정적 흐름이 잘 드러나는 완곡 | 한 번에 정확한 가사 전달 |
| 긴 연주곡과 영화 같은 전개 | DAW 확인 없이 프레임 단위의 섹션 타이밍 맞추기 |
| 다국어 보컬 아이디어 구상 | 엄격한 부정 제약 조건 |
| 곡별 API 요금을 간단하게 책정하고 싶은 개발자 | 결정론적 재생이 필요한 사용자 |
더 광범위한 범주별 비교를 위해, 기존의 ElevenLabs vs Lyria 3 Pro vs Mureka 음악 테스트 이는 순수한 음성 제어보다 완성도 높은 음악적 구조가 더 중요할 때, 왜 리리아가 가장 적합한지 보여줍니다.
Lyria 3 Pro란 무엇인가요?
Lyria 3 Pro는 Lyria 3 API 제품군에 속하는 구글의 전체 곡 음악 생성 모델입니다. 구글은 2026년 3월 25일 Lyria 3 Pro를 발표했습니다., 최대 3분 길이의 트랙을 제작할 수 있도록 설계되었으며, 인트로, 절, 코러스, 브릿지, 가사, 템포, 악기 편성을 자유롭게 조절할 수 있습니다. 더 작은 크기의 ‘Lyria 3 Clip’ 모델은 30초 분량의 고정 길이의 결과물을 생성하는 데 중점을 둔 반면, ‘Pro’ 모델은 완성도 높은 편곡을 위한 모델입니다.
그리고 최신 Gemini 음악 생성 가이드 Lyria 3의 두 모델 모두 텍스트와 이미지를 입력으로 받아 44.1 kHz 스테레오 오디오를 출력한다고 합니다.
그리고 Google Cloud Lyria 프롬프트 가이드 PDF 및 최대 10장의 참조 이미지를 포함한 더 광범위한 클라우드 측 입력 자료를 처리합니다. 이는 특정 플랫폼에 한정된 기능이므로, 모든 입력 유형이 모든 타사 경로를 통해 작동한다고 가정해서는 안 됩니다.

Lyria 3 Pro 테스트 방법
이번 실습 테스트에서는 모델 ID가 지정된 Broly Anywhere Tasks API 엔드포인트를 사용했습니다. lyria-3-pro. 이곳은 사용자의 승인된 테스트 장소였으며, Gemini의 공식 소비자용 UI는 아니었습니다. 저희는 동일한 프롬프트에 대한 재현성, 사용자 지정 가사, 시간 기반 구조, 악기 재현 정확도, 장문 일관성, BPM/키/악기 제어, 스페인어 및 일본어 보컬, API 아티팩트 등 18가지 과제를 수행했습니다.
증거는 세 가지 계층으로 구성됩니다. 파일 및 API 관련 정보—재생 시간, MP3 형식, 샘플 레이트, 비트레이트, 채널 수, 처리 시간, 보고된 비용—는 응답 결과와 다운로드된 오디오 파일에서 직접 추출되었습니다. Gemini 3.6 플래시 오디오 분석 과정을 통해 아래에서 사용된 청취 설명과 최선의 가사 전사본이 생성되었습니다. 이는 인간 패널이나 인간 MOS가 아닌, 모델 기반 청취 평가입니다. 정확한 BPM, 키, 섹션 타임스탬프는 DAW에서 독립적으로 측정되지 않은 경우 잠정적인 것으로 간주됩니다.
| 테스트 지표 | 측정 결과 |
|---|---|
| 성공한 작업 | 18/18 |
| 생성된 오디오 총량 | 1,858.195초 |
| 파일 전달 | MP3, 44.1 kHz, 192 kbps, 스테레오, 18/18 |
| 생성 시간 | 46–75초; 중앙값 55.5초 |
| 보고된 행사장 비용 | 작업당 $0.08; 총 $1.44 |
| 지속 시간 정확도 | 17/18, 목표치에서 5초 이내 |
| 평균 절대 지속 시간 오차 | 2.913초 |
작업이 이미 생성된 후 두 건의 네트워크 읽기 작업이 실패했습니다. 러너는 해당 작업들을 다시 제출하는 대신 기존 작업 ID를 재개했기 때문에, 이 세트에는 여전히 18개의 고유한 작업과 18개의 고유한 결과가 포함되어 있었습니다.

Lyria 3 Pro의 음질: 세련된 사운드, 다소 들쑥날쑥한 조작감
전반적인 음악성과 믹싱
청취 평가에서는 가장 뛰어난 결과물들을 일관되게 ’세련되고, 일관성이 있으며, 믹싱이 훌륭하다’고 평가했다. T01의 신스팝 반복 트랙들은 밝은 아르페지오 신스, 일렉트로닉 드럼, 기타 악센트, 여성 보컬, 그리고 희망찬 분위기를 고스란히 유지했다. T05의 두 포스트 록 트랙은 뻔한 짧은 루프로 흐지부지되지 않고, 한눈에 알아볼 수 있는 긴 형식의 전개 구조를 유지했다.
그렇다고 해서 요청된 모든 세부 사항이 그대로 반영된 것은 아닙니다. T01-R1은 요청된 신스 리드를 독립적인 솔로로 만들지 않고 아웃트로에 녹여 넣은 반면, T01-R3은 솔로를 생략했고 고음역대에서 미묘한 보컬 합성 아티팩트가 드러났습니다. T01-R2가 가장 원본에 가깝게 재현되었습니다.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
정확한 가사: 가능하지만, 필연적인 것은 아님
맞춤 가사 테스트는 여러 버전을 생성해야 하는 가장 확실한 이유입니다. T02-R1은 마지막 브릿지 구절의 대부분을 생략했습니다. T02-R2는 코러스 뒤에 에코 반복을 추가했습니다. T02-R3는 최선의 노력을 기울여 전사한 결과, 제공된 가사 텍스트를 정확히 따랐습니다.
이 기능 덕분에 작업이 편리해지긴 하지만, 작업 흐름이 달라집니다. 첫 번째 절이 정확하다고 해서 곡을 승인해서는 안 됩니다. 믹싱이나 배포 단계로 넘어가기 전에, 반복되는 코러스와 마지막 구절을 포함해 전체 보컬을 원본 가사와 비교해 확인하십시오.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
구성 및 시간 제한이 있는 문제 유형
120초 분량의 세 곡 모두, 요청된 거시적 구성 순서, 즉 필터링된 인트로, 첫 번째 절, 웅장한 코러스, 첼로/그레뉴러 브레이크, 더욱 강렬한 두 번째 절, 마지막 코러스, 그리고 두 개의 코드로 마무리되는 엔딩을 따랐다고 설명되었다. 실제 파일의 길이는 115.148초에서 117.029초 사이였으므로, 120초라는 목표 시간을 정확히 맞춘 곡은 없었습니다.
또한 평가 도구는 일부 실행에서 실제 파일 재생 시간을 초과하는 비현실적인 타임스탬프를 생성하기도 했다. 따라서 도출할 수 있는 유용한 결론은 제한적이다: Lyria 3 Pro는 요청된 시퀀스를 처리했으나, 이 테스트만으로는 섹션 배치가 프레임 단위로 정확하다는 것을 입증할 수는 없습니다. 코러스를 특정 편집 지점에 정확히 맞춰야 한다면 DAW를 사용하세요.
계측 정확도와 가장 큰 재현성 문제
T04-R1은 첼로 오스티나토, 드론, 유리 같은 질감, 절제된 음량 피크, 그리고 미해결된 결말을 통해 의도된 공상과학 서스펜스 분위기를 잘 전달했습니다. T04-R2는 동일한 프롬프트를 사용했으나 클래식 실내악 현악기 방향으로 치우쳤습니다. 뮤트 처리된 피아노의 박동감, 아날로그 드론, 유리 같은 배음은 빠져 있었습니다.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
이 두 가지 조합은 실제 제작 과정에서 발생할 수 있는 위험 요소를 보여주기 때문에, 단 하나의 완벽한 데모보다 더 유용합니다. 상세한 프롬프트를 사용하면 성공 확률을 높일 수 있으며, 이는 편곡을 고정시키는 것은 아닙니다. 악기 구성이 중요한 경우에는 최소 두 가지 버전을 생성하십시오.
장문 일관성
3분 길이의 포스트 록 요청곡 두 곡 모두 전체 전개에 걸쳐 일관성을 유지했다. T05-R1은 176.170초, T05-R2는 177.006초에 이르렀다가, 다시 도입부의 기타 멜로디로 돌아왔다. 두 청취 보고서 모두 갑작스러운 장르 전환이나 끊긴 듯한 결말에 대해서는 지적하지 않았다.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
바로 이 점에서 ‘Pro’라는 이름이 실감 나게 됩니다. Lyria 3 Clip은 루프나 짧은 미리 듣기에 유용하지만, Lyria 3 Pro는 실제 곡의 초안, 예고편 음악, 영상 사운드트랙에 충분한 길이의 편곡을 완성할 수 있습니다.
다국어 보컬
스페인어와 일본어 샘플은 모두 알아듣기 쉬우며 제공된 가사와 유사하다는 평가를 받았다. 최대한 정확하게 전사한 내용을 보면, 각 공연에서 마지막 코러스 구절을 음악적 하이라이트로 변형시킨 것으로 보인다. 이는 사소한 창작적 자유이지만, 여전히 가사의 변경에 해당한다.
Broly Anywhere Tasks 행사에서 나온 대표적인 결과물입니다. 원어민의 검토를 권장합니다.
Google Cloud는 영어, 독일어, 스페인어, 프랑스어, 힌디어, 일본어, 한국어, 포르투갈어를 지원 언어로 명시하고 있습니다. 스페인어와 일본어 샘플 각각 하나씩으로는 8개 언어 모두에서 동일한 품질을 입증할 수 없으므로, 원어민 검토가 여전히 합리적인 출시 기준이 됩니다.
부정 제약 조건은 실패할 수 있다
T08은 보컬, 대사, 합창, 라이저, 영화적 효과음을 포함하지 말 것을 요청했습니다. 그러나 청취 평가 결과물에는 124 BPM의 미니멀 테크노라는 주요 방향성과 깔끔한 종료 처리 등이 반영되었음에도 불구하고, 여전히 짧은 보컬 챕과 라이저가 포함되어 있었습니다.
‘Broly Anywhere Tasks’ 행사에서 선보인 대표적인 결과물.
Google Cloud의 모델 페이지에는 부정 프롬프트가 지원되지 않는다고 명시되어 있습니다. 자연어로 긍정적 제외 조건을 작성할 수는 있지만, 그 결과는 엄격한 필터가 아닌 참고 사항으로 간주해야 합니다.

Lyria 3 Pro 프롬프트: 가장 효과가 좋았던 공식
구글의 프롬프트 가이드에서는 장르, 분위기, 악기 구성, 템포, 보컬, 가사를 조합할 것을 권장합니다. 가장 효과적인 프롬프트에는 여기에 두 가지 요소가 더 추가되었는데, 바로 명확한 섹션 순서와 구체적인 마무리 방식입니다.

Lyria 3 Pro를 활용하는 실용적인 프롬프트 공식은 다음과 같습니다:
- 길이 및 형식: “90초 분량의 기악곡을 만들어 보세요.”
- 장르와 분위기: 주요 스타일 하나와 감정적 방향성 하나를 각각 하나씩 꼽아 보세요.
- 템포, 조, 박자: 중요한 경우에는 정확한 수치를 사용하십시오.
- 악기 편성: 이 편곡을 특징짓는 음들을 나열해 보세요.
- 보컬 및 작사: 음성 유형, 언어, 발음, 그리고 정확한 대사를 지정해 주세요.
- 구조: 인트로, 절, 코러스, 브릿지, 솔로, 아웃트로를 정의하십시오.
- 결말: 클린 스톱, 해결된 화음, 미해결 화음 또는 페이드를 요청합니다.
가장 흔한 실수는 너무 많은 제약 조건을 요구하고, 이를 보장된 사항으로 간주하는 것입니다. T04와 T08의 실패 사례는 프롬프트 이후에 ‘무분별한 게시’ 단계가 아닌 ‘선별 단계’가 따라야 하는 이유를 보여줍니다.
시험에서 사용된 정확한 문제 문구
아래 프롬프트는 본 리뷰에서 다룬 실행에 대해 전송된 정확한 텍스트입니다.
T01 — 동일한 프롬프트를 사용한 신스팝의 반복성
사용된 프롬프트
프롬프트
112 BPM, 4/4 박자의 세련된 90초 분량 영어 신스팝 곡을 제작해 주세요. 분위기: 힘든 밤을 보낸 뒤의 희망찬 느낌. 악기 구성: 따뜻한 아날로그 신스 베이스, 밝은 아르페지오 신스, 탄탄한 일렉트로닉 드럼, 깔끔한 일렉트릭 기타 악센트, 그리고 짧은 멜로디 신스 솔로. 발음이 명확한 자연스러운 여성 리드 보컬을 한 명 사용하십시오. 10초짜리 인트로, 1절, 프리코러스, 기억에 남는 코러스, 2절, 코러스 반복, 짧은 신스 솔로, 깔끔하게 마무리되는 아웃트로로 구성된 오리지널 가사를 작성하십시오. 믹스는 공간감이 있고 라디오 방송에 적합하도록 구성하며, 내레이션이나 군중 소리는 피하십시오.
T02 — 정확한 맞춤 가사
사용된 프롬프트
프롬프트
96 BPM의 100초 분량 얼터너티브 팝 곡을 제작해 주세요. 곡에는 아늑한 피아노, 뮤트 처리된 일렉트릭 기타, 부드러운 베이스, 절제된 드럼, 그리고 표현력 풍부한 남성 리드 보컬 한 명이 포함되어야 합니다. 다음의 오리지널 가사를 정확히 따라 부르되, 구조를 나타내는 섹션 라벨은 그대로 유지하되 라벨 자체를 말하지 마세요. 작사에 명시된 반복되는 코러스 부분 이외에 가사 줄을 추가, 생략, 순서 변경 또는 반복하지 마십시오.
[1절]
복도 시계는 5분 늦게 가고 있었어
문 아래로 푸른 아침이 기다리고 있었지
우린 한 번도 쓰지 않은 지도를 가방에 챙겼고
2층에 불 하나만 켜 둔 채 떠났어
[코러스]
오늘 밤 길이 우리 이름을 잊어버린다면
강을 따라가, 빛을 따라가
다리가 휘어지는 곳에서 내가 기다릴게
우리가 끝맺지 못한 그 음을 품고
[2절]
종이 달이 대시보드 유리를 가로질렀어
도시는 은빛 비 속에 녹아내렸지
라디오의 잡음 속에서 네 목소리가 들렸어
그리고 다시 침묵 속으로 채널을 돌렸지
[후렴]
오늘 밤 길이 우리 이름을 잊어버린다면
강을 따라가, 빛을 따라가
다리가 휘어지는 곳에서 내가 기다릴게
우리가 끝맺지 못한 그 음표를 품고
[브릿지]
마지막 말도, 끝을 알리는 신호도 없어
그저 내 곁에 놓인 네 작은 나침반뿐
브릿지 이후 짧은 기악 연주로 마무리한다.
T03 — 시간 기반 구조 제어
사용된 프롬프트
프롬프트
E 단조, 100 BPM의 120초 분량 시네마틱 일렉트로닉 곡을 제작하고, 다음 타임라인을 최대한 준수해 주세요: 0:00-0:10 필터링된 신스 사운드와 멀리서 들려오는 펄스 리듬의 인트로; 0:10-0:35: 드문드문한 킥이 가미된 낮은 여성 보컬의 절; 0:35-0:55: 풍성한 드럼과 층층이 쌓인 하모니가 어우러진 광활한 코러스; 0:55-1:15: 첼로와 그레뉴라 신스가 주도하는 기악 브레이크; 1:15-1:38: 베이스가 더 강조된 두 번째 절; 1:38-1:55: 마지막 코러스; 1:55-2:00: 페이드 없이 단호하게 끝나는 두 개의 코드로 구성된 엔딩. 원본 영어 가사는 해가 뜨기 전 도시를 가로지르는 내용을 담아야 합니다. 음악 외의 말소리나 소리는 포함하지 마십시오.
T04 — 기기의 충실도
사용된 프롬프트
프롬프트
보컬, 속삭임, 염송, 대사, 합창이 전혀 포함되지 않은 90초 분량의 기악 시네마틱 음악을 제작해 주세요. 스타일: 72 BPM의 절제된 SF 서스펜스. 사용 악기: 저음 첼로 오스티나토, 뮤트 처리된 피아노의 박동감, 부드러운 아날로그 드론, 브러시로 연주하는 프레임 드럼, 그리고 간헐적으로 등장하는 유리 하모닉스. 간결한 오프닝에서 시작해 1:05에 한 번의 절제된 클라이맥스로 이어지도록 구성하고, 페이드 아웃 없이 명확하지만 해결되지 않은 화음으로 끝맺으십시오. 음향적 깊이감을 일관되게 유지하고 저음역대는 깔끔하게 처리하십시오.
T05 — 장문 일관성
사용된 프롬프트
프롬프트
D 단조, 6/8 박자, BPM 약 84의 180초 분량 포스트 록 기악곡을 제작하십시오. 핑거피킹 방식의 일렉트릭 기타와 실내 잔향음으로 시작하고, 30초 후에 베이스와 톰을 도입하며, 70초 후에 절제된 현악 4중주를 추가하십시오. 2분 05초에서 2분 35초 사이에 메인 크레센도에 도달한 후, 오프닝 기타 모티프로 돌아와 3분 00초까지 깔끔하게 마무리하십시오. 보컬, 합창, 나레이션, 음향 효과는 사용하지 마십시오. 곡 전체에 걸쳐 한 가지 알아볼 수 있는 4음 모티프를 유지하며, 갑작스러운 장르 변화, 루핑으로 인한 인공적인 소리, 또는 끊기는 듯한 끝맺음은 피하십시오.
T06 — BPM, 조, 박자, 솔로 타이밍
사용된 프롬프트
프롬프트
F# 단조, 4/4 박자, 정확히 92 BPM의 100초 분량 네오 소울 그루브 악곡을 제작하십시오. 로즈 일렉트릭 피아노, 핑거스타일 일렉트릭 베이스, 드라이 림 클릭 드럼, 뮤트 처리된 리듬 기타를 사용하며, 약 0:55부터 1:15까지 테너 색소폰 솔로 한 번을 포함시키십시오. 화성은 F# 단조를 중심으로 구성하고, 세련된 싱코페이션을 활용하며, 보컬과 합창은 배제하고, 페이드 아웃 대신 의도적으로 밴드가 연주를 멈추는 방식으로 끝맺으십시오.
T07A — 스페인어 보컬
사용된 프롬프트
프롬프트
104 BPM의 90초 분량 스페인어 어쿠스틱 팝 곡을 제작해 주세요. 악기 구성은 나일론 현 기타, 업라이트 베이스, 핸드 퍼커션, 부드러운 피아노, 그리고 자연스러운 여성 리드 보컬 1명이 포함되어야 합니다. 다음의 오리지널 가사를 명확하게 불러 주시고, 번역하지 마세요: [Verse] 도시의 불빛들 사이에서, 나는 종이 지도를 간직하고 있다. 모든 거리가 다시 말을 걸고, 모든 그림자는 그 사람을 알고 있다. [코러스] 강을 따라 바다까지 가라, 두려움은 역에 남겨두어라. 밤이 다시 찾아온다면, 나는 또 다른 노래를 불렀다. 코러스를 한 번 반복하고, 짧은 기타 간주부를 추가한 뒤, 나레이션 없이 깔끔하게 마무리해 주세요.
T07B — 일본어 보컬
사용된 프롬프트
프롬프트
108 BPM의 90초 분량 일본어 드림 팝 곡을 제작해 주세요. 클린 일렉트릭 기타, 따뜻한 신스 패드, 멜로디컬한 베이스, 가벼운 일렉트로닉 드럼, 그리고 자연스러운 여성 리드 보컬 한 트랙이 포함되어야 합니다. 다음의 오리지널 가사를 명확하게 부르고, 번역하지 마십시오: [Verse] 새벽이 오기 전의 역에서, 고요한 바람을 기다린다. 잊혀진 지도 위에서, 푸른 빛이 흔들린다. [Chorus] 강을 건너가자, 이름 없는 내일로. 작은 노래를 품고, 다시 한 번 걸음을 내딛는다. 코러스를 한 번 반복하고, 짧은 악기 브릿지를 삽입한 뒤, 나레이션 없이 깔끔하게 마무리하십시오.
T08 — API 아티팩트 및 부정 제약 조건 테스트
사용된 프롬프트
프롬프트
A 단조, 124 BPM의 60초 분량 미니멀 테크노 기악곡을 제작하십시오. 드라이한 킥, 타이트한 클로즈드 하이햇, 둥근 느낌의 모노 베이스, 하나의 메탈릭 퍼커션 모티프, 그리고 서서히 펼쳐지는 필터링된 신스 사운드를 포함해야 합니다. 보컬, 나레이션, 합창, 라이저, 영화적 음향 효과는 포함하지 마십시오. 편곡은 의도적으로 단순하게 유지하고, 끝부분은 깔끔한 1비트 스톱으로 마무리하여 반환된 재생 시간, 형식, 샘플 레이트, 비트레이트, 채널 수, 메타데이터 블록 및 종료 동작을 확인할 수 있도록 하십시오.
Lyria 3 Pro 가격
Google의 Gemini 개발자 API 요금 페이지 Lyria 3 Pro 미리보기를 다음에서 확인할 수 있습니다. 전체 곡 요청당 $0.08 그리고 ‘Lyria 3’ 클립 미리보기는 30초 분량의 곡당 $0.04. 두 Lyria 모델 모두 Gemini API 무료 이용 한도가 없습니다. 요금은 토큰 단위가 아닌 요청 건당으로 부과됩니다.

경로
Gemini 개발자 API
모델 / 제품
lyria-3-pro-미리보기
검토 대상 모델
공시 가격
전체 곡당 $0.08
중요한 제한 사항
무료 요금제 없음; 미리보기 모델
경로
Gemini 개발자 API
모델 / 제품
lyria-3-클립-미리보기
공시 가격
30초 분량의 곡당 $0.04
중요한 제한 사항
단축형 역할 수정됨
경로
Google 클라우드
모델 / 제품
Lyria 3 Pro 미리 보기
공시 가격
현재 Lyria 가격 확인하기
중요한 제한 사항
미리보기 약관 및 할당량 제한이 적용됩니다.
경로
Gemini 소비자용 제품
모델 / 제품
리리아 음악 세대
공시 가격
구독 이용 권한은 요금제 및 지역에 따라 다릅니다.
중요한 제한 사항
API와 청구 경로가 다릅니다.
경로
‘Broly Anywhere’ 루트 테스트 완료
모델 / 제품
lyria-3-pro
공시 가격
API 응답에 $0.08의 업스트림 비용이 표시됨
중요한 제한 사항
장소에 따라 달라지는 사항일 뿐, 소매업체의 약속이 아닙니다
구독 관련 내용을 다루려면 현재 상태에서 시작하세요. Google AI Plus 리뷰와 숨겨진 한계.
그리고 Google AI Plus와 Pro 요금제 비교 API 액세스와 혼동하기 쉬운 플랜 한도를 구분합니다.
가격만 확인하려면 최신 정보를 참조하십시오. Google AI Plus 구독 요금.
지역별 접속 가능 여부는 변경될 수 있으며, Google AI Plus 미국 출시 현황 및 가격 분석 소비자 구독이 왜 보편적인 API 접근 권한으로 간주되어서는 안 되는지 설명합니다.
가격이 결정적인 요소라면, 단순한 계산만으로도 매력적입니다. 10 Pro 세대의 가격은 세금이나 플랫폼 조정 비용을 제외하면 $0.80입니다. 숨겨진 비용은 큐레이션에 소요되는 시간입니다. 정확한 가사나 악기 편성을 얻기 위해서는 API 자체의 비용이 저렴하더라도 여러 번의 출력이 필요할 수 있습니다.
Lyria 3 Pro API: 모델 ID, 요청 및 출력
공식 Gemini 경로를 이용하려면 다음을 사용하십시오. Gemini Interactions API 음악 워크플로우 모델 ID와 함께 lyria-3-pro-미리보기. 이 응답은 생성된 오디오 및 생성된 텍스트에 대한 편리한 속성을 제공합니다. 오디오는 base64로 인코딩되어 있으며, 텍스트에는 가사나 구조적 정보가 포함될 수 있습니다.

구글의 최신 문서를 바탕으로 한 파이썬 예제
파이썬
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="lyria-3-pro-preview",
input=(
"E 단조로 된 90초 분량의 시네마틱 일렉트로닉 곡. "
"필터링된 펄스로 시작해, 웅장한 코러스로 전개되고, "
"첼로가 주도하는 악기 브레이크를 추가한 뒤, 페이드 없이 끝나는 곡입니다."
),
)
generated_audio = interaction.output_audio
if generated_audio:
with open("lyria-song.mp3", "wb") as file:
file.write(base64.b64decode(generated_audio.data))
lyrics_or_structure = interaction.output_text
if lyrics_or_structure:
print(lyrics_or_structure)
구글의 가이드에 따르면 MP3가 기본 설정이라고 합니다. 또한 다음과 같이 설명하고 있습니다. response_format={"type": "audio"} 해당 Interactions API 흐름에서 지원하는 형식(문서에 명시된 WAV 옵션 포함)으로 프로 오디오 출력을 요청하기 위함입니다. Google Cloud의 현재 모델 페이지에는 MP3, 44.1 kHz, 192 kbps만 나열되어 있어 지원 범위가 더 좁습니다. 포맷을 설명할 때는 하나의 범용 사양을 제시하기보다는 구체적인 명칭을 명시하십시오.
테스트한 Anywhere 경로도 비동기 방식이었지만, 해당 작업 스키마는 장소별로 다릅니다. 이 경로는 작업 ID, 상태, 진행률, 오디오 URL, 타임스탬프, 제공업체 및 비용 필드를 반환했습니다. 해당 응답 형식을 Gemini 코드에 그대로 붙여넣고, 이것이 Google의 공식 스키마라고 가정해서는 안 됩니다.
Lyria 3 Pro vs Lyria 3 Clip vs Lyria 3.5
| 모델 | 최적의 사용법 | 길이 | 2026년 8월 채용 공고 |
|---|---|---|---|
| Lyria 3 클립 미리보기 | 루프, 미리 듣기, 짧은 영상용 음악 | 30초 | Gemini API 미리 보기; $ 0.04/요청 |
| Lyria 3 Pro 미리 보기 | 전체 곡, 절, 코러스, 브릿지 | Google Cloud에서 최대 184초 | Gemini/Google Cloud 미리 보기; $0.08/요청 |
| Lyria 3.5 | 최신 세대의 음질과 ‘Flow Music’ 제작 | 현재 DeepMind 위치 파악 방식에서는 최대 3분까지 | Flow Music을 통해 홍보됨; 이 API 테스트에 사용된 모델 ID가 아님 |
속도와 간결한 결과물이 중요하다면 ‘Clip’을 선택하세요. 문서화된 API를 통해 완성된 곡이 필요하다면 ‘Pro’를 선택하세요. Pro API 모델 ID를 사용하는 것보다 최신 Flow Music 경험을 더 중요하게 생각한다면 ‘Lyria 3.5’를 선택하세요.
리리아는 범용 오디오 모델보다 범위가 더 좁습니다. 생성된 한 장면에서 대사, 폴리, 배경음, 음악이 혼합되어 있는 경우, Seed Audio 1.0 음성, 효과음 및 음악 리뷰 해당 워크플로를 다룹니다.
영상 제작에 대해서는 다음 내용을 참고하세요 Veo 3.1은 사운드와 배경 오디오를 처리합니다..
말하기 실력과 발음의 일치 문제가 더 까다로운 경우에는 실용적인 방법을 사용하세요. Veo 3.1 대화, 오디오 및 입모양 동기화 워크플로우.
안전성, SynthID, 상업적 이용 및 제한 사항
구글에 따르면 Lyria 3의 출력 결과물에는 SynthID 워터마킹이 포함된다. 이 현재 Google Cloud 사양 또한 콘텐츠 자격 증명(C2PA), 입력 필터링, 출력 낭독 필터링, 음성 유사도 필터링도 나열되어 있습니다. 이러한 제어 기능은 출처 추적 및 안전성을 보장하지만, 자체 프로젝트에 사용할 가사, 참조 이미지, 샘플, 초상권 및 배포 권리에 대한 승인을 받아야 할 필요성을 없애주지는 않습니다.

구글 클라우드는 ‘Lyria 3 Pro’를 생성형 AI 프리뷰 서비스로 분류하고 있습니다. 해당 페이지에 따르면, 고객은 프리뷰 버전을 실제 운영 또는 상업적 목적으로 사용하거나 생성된 결과물을 제3자에게 공개할 수 있으나, 이는 출시 전(Pre-GA) 이용 약관 및 접근 권한에 관한 계약의 적용을 받습니다. 이는 생성된 모든 트랙이 위험이 없거나 독점적이라는 무조건적인 약속과는 다릅니다.
실질적인 한계는 다음과 같이 간단합니다:
- 미정식 버전의 모델은 정식 출시 전에 변경될 수 있습니다.
- Gemini API 요금제에는 Lyria 3용 무료 사용 한도가 없습니다.
- 현재 Google Cloud 모델 페이지에서는 프롬프트 하나당 오디오 클립 하나를 반환합니다.
- 부정적 프롬프트는 공식적인 기능으로 지원되지 않습니다.
- 현재 Gemini 음악 생성 기능은 인플레이스 멀티턴 편집기가 아닌 싱글턴 방식입니다.
- 치료 기간과 지침 준수 정도는 사람마다 다릅니다.
- 정확한 가사, BPM, 키, 타임스탬프에 대해서는 여전히 출력 단계의 품질 검증이 필요합니다.
Lyria 3 Pro는 어떤 분들에게 적합할까요?
API를 통해 완성도 높은 음악 아이디어를 얻고 여러 후보 곡을 검토하고자 하는 개발자, 영화 제작자, 게임 제작자, 작곡가 또는 콘텐츠 팀이라면 Lyria 3 Pro를 사용해 보세요. 특히 영화적 전개, 팝 곡 구조, 긴 기악 구절, 다국어 보컬 데모 제작에 탁월한 성능을 발휘합니다.
확정적인 스템, 생성 후 정밀한 편집, 보장된 네거티브 제약 조건, 또는 단 한 번의 요청으로 완성된 마스터링 버전이 필요하다면 이 도구는 건너뛰거나, 별도의 도구를 따로 준비해 두세요. Lyria 3 Pro는 마치 DAW의 오토메이션 레인처럼 모든 지시를 일일이 따르기보다는, 인상적인 테이크를 생성하는 데 더 뛰어납니다.
GlobalGPT의 브라우저 기반 오디오 도구 이 플랫폼은 음성 인식 및 전사 작업을 한 곳에서 지원할 수 있지만, 해당 공개 페이지는 여기서 테스트한 Lyria API와는 별개의 제품 환경입니다. 본 리뷰는 해당 페이지가 검증된 Lyria 3 Pro 경로라고 주장하지 않습니다.
Google Lyria 3 Pro 자주 묻는 질문
Lyria 3 Pro가 구글의 최신 음악 모델인가요?
아닙니다. 2026년 8월 10일 현재, 구글 딥마인드는 ‘Lyria 3.5’를 최신 음악 생성 모델로 소개하며, ‘Flow Music’을 통해 이를 홍보하고 있습니다. ‘Lyria 3 Pro’는 여전히 Gemini 및 구글 클라우드 개발자 경로를 위한 공식 문서화된 전체 곡 미리 듣기 모델로 남아 있습니다. lyria-3-pro-미리보기.
Lyria 3 Pro의 가격은 얼마인가요?
Gemini 개발자 API에 따르면, Lyria 3 Pro Preview는 전체 곡 요청당 $0.08이 부과됩니다. Lyria 3 Clip Preview는 30초 분량의 곡당 $0.04가 부과됩니다. 두 모델 모두 Gemini API 무료 이용 한도가 없으며, 소비자 구독의 경우 다른 요금제 및 지역별 규정이 적용됩니다.
Lyria 3 Pro에서 재생할 수 있는 노래의 최대 길이는 얼마인가요?
구글의 공식 발표에 따르면 최대 3분까지 가능하다고 합니다. 현재 구글 클라우드 기술 문서에는 오디오 클립의 최대 길이가 184초로 명시되어 있습니다. 180초 길이의 클립으로 두 차례 테스트를 진행한 결과, 반환된 MP3 파일의 길이는 각각 176.170초와 177.006초였습니다.
Lyria 3 Pro는 사용자가 지정한 가사를 정확히 따라 부를 수 있나요?
네, 하지만 결정론적인 방식은 아닙니다. 반복된 세 가지 사용자 지정 가사 중 하나는 청취 전사본에서 제공된 텍스트와 정확히 일치했습니다. 또 다른 하나는 마지막 브릿지 구절의 대부분을 생략했고, 세 번째는 에코 효과를 얹어 반복했습니다. 항상 전체 보컬을 원본 가사와 비교해야 합니다.
Lyria 3 Pro로 보컬이 없는 기악곡을 생성할 수 있나요?
네, 하지만 서면으로 명시된 제외 사항이 절대적인 보장은 아닙니다. 한 가지 악기 중심 테스트에서는 보컬이 전혀 포함되지 않은 반면, “최소 테크노” 제약 조건 테스트에서는 “보컬 없음”이라는 조건에도 불구하고 보컬 챕이 추가되었습니다. 또한 Google Cloud는 현재 모델 페이지에서 부정적인 프롬프트를 지원되지 않는 것으로 표시하고 있습니다.
Lyria 3 Pro API 모델 ID는 무엇인가요?
Gemini의 공식 모델 ID 및 Google Cloud 모델 ID는 다음과 같습니다. lyria-3-pro-미리보기. 이번 리뷰에서 체험해 본 장소에서는 타사 경로 ID를 사용했습니다 lyria-3-pro; 이 스키마와 명명법은 Google의 공식 Interactions API를 대체해서는 안 됩니다.
Lyria 3 Pro는 어떤 파일 형식으로 결과를 출력하나요?
구글의 Gemini 가이드에 따르면 MP3가 기본 설정이며, Interactions API에 Pro 출력 형식 옵션이 명시되어 있습니다. Google Cloud에는 44.1 kHz, 192 kbps MP3가 명시되어 있습니다. 테스트한 경로에서 얻은 18개의 파일 모두 이 44.1 kHz, 192 kbps 스테레오 MP3 사양과 일치했습니다.
Lyria 3 Pro를 상업적으로 사용할 수 있나요?
Google Cloud는 고객이 사전 출시(Pre-GA) 약관 및 이용 계약의 조건에 따라 이 프리뷰 서비스를 운영 환경이나 상업적 목적으로 사용하거나 생성된 결과물을 공개할 수 있다고 밝혔습니다. 해당 약관을 검토하고, 배포 전에 가사, 초상, 샘플 또는 참조 미디어에 대한 사용 권한을 확보하시기 바랍니다.
GlobalGPT에서 Lyria 3 Pro를 사용할 수 있나요?
이 리뷰는 GlobalGPT Lyria 노선이 공식적으로 검증되었다고 주장하지 않습니다. 18개의 실습 세션은 Broly Anywhere Tasks API를 통해 진행되었으며, GlobalGPT의 공개 오디오 페이지에는 현재 별도의 음성 및 텍스트 변환 작업 공간이 제공되고 있습니다. 문서화된 공식 API 경로를 이용하려면 Gemini 또는 Google Cloud를 사용하십시오.
최종 판결
Google Lyria 3 Pro는 요청당 비용이 저렴하고, 일관성 있는 장문 출력을 제공하며, 유난히 세밀한 프롬프트 제어 기능을 갖춘 신뢰할 수 있는 전체 곡 생성 API 모델입니다. 18회 실행 테스트를 통해 출시 데모에서는 드러나지 않았던 부분도 확인되었는데, 구조적 세부 사항, 정확한 가사, 악기 명칭, 부정 제약 조건 등이 동일한 요청 사이에서도 달라질 수 있다는 점입니다.
두세 개의 후보를 생성하고, 전체 곡을 비교한 뒤 가장 뛰어난 버전을 선택할 수 있다면 이러한 타협은 수용할 만합니다. 이러한 워크플로우의 경우, Lyria 3 Pro를 자신 있게 추천할 수 있습니다. 단 한 번의 요청으로 결정론적인 가사 출력이나 편집에 바로 활용할 수 있는 정밀도를 얻으려면, 여전히 사람의 검토와 DAW가 필요합니다.



