ElevenLabs Music v2 리뷰: 실제 성능, API 및 프롬프트

elevenlabs-music-v2-리뷰-hero-3x2-v2

AI 음악 분야는 빠르게 발전하고 있으며, ElevenLabs Music v2는 가장 야심 찬 신곡 생성 모델 중 하나입니다. 하지만 이 모델이 제공된 가사를 그대로 유지하고, 세밀한 편곡을 따르며, 대대적인 편집 없이도 바로 사용할 수 있는 트랙을 만들어낼 수 있을까요?

우리는 신스팝 보컬 곡, 시네마틱 기악곡, 8부 구성의 얼터너티브 팝 편곡 등 세 가지 90초 분량의 원본 브리프를 사용하여 테스트를 진행했습니다. 이 리뷰에서는 오디오 품질, 프롬프트 준수 여부, 생성 시간, 작업 보고 비용, 공식 제어 기능, API 접근성 등을 다룹니다.

간단한 답변: ElevenLabs Music v2는 얼마나 좋은가요?

간단한 평가

ElevenLabs Music v2는 기획서에서 노골적인 가사와 섹션별 제어를 요구했을 때 가장 뛰어난 성과를 보였습니다. 요청받은 90초 분량의 파일 세 개를 모두 생성해 주었고, 가사 테스트에서 제공된 단어를 그대로 유지했으며, 요청받은 여덟 개의 노래 구절을 명확하게 들을 수 있게 해주었습니다.

가장자리 부분에서는 다소 정확도가 떨어졌습니다. 악기 연주의 한 부분이 요청된 시점보다 일찍 시작되었고, 다른 악기 연주의 한 구간은 너무 길게 이어졌으며, 구조화된 곡의 끝부분은 프롬프트에 명시된 깔끔한 마지막 화음보다는 페이드 아웃처럼 마무리되었습니다.

  • 가장 잘 관찰된 강도: 가사와 곡의 구조.
  • 주요 한계: 세부적인 타이밍과 마무리 지침이 항상 정확하지는 않았다.
  • 테스트 범위: 3회의 통제된 API 실행 결과일 뿐, 업계 벤치마크는 아닙니다.

ElevenLabs Music v2는 GlobalGPT의 오디오 생성기를 통해서도 이용할 수 있습니다. 이 방법을 사용하면 하나의 계정에 여러 오디오 및 AI 모델을 통합할 수 있으며, 별도의 VPN이나 서비스 제공업체 설정을 거칠 필요가 없고, 여러 개의 독립형 구독을 유지하는 데 드는 비용을 절감할 수 있습니다.

ElevenLabs Music v2 개요

결과를 살펴보기 전에, 모델에 대해 공개된 특징 집합과 세 가지 프롬프트가 실제로 입증할 수 있는 바를 구분해 두는 것이 도움이 됩니다.

ElevenLabs Music v2란 무엇인가요?

ElevenLabs는 2026년 5월 26일에 Music v2를 출시했습니다. 노래와 반주곡을 생성하는 업그레이드된 음악 생성 모델입니다. 이 회사는 이번 출시를 통해 보컬, 악기 연주, 편곡, 다국어 지원, 가사의 밀도 있는 전달, 장르 전환, 인페인팅 기능이 개선되었다고 밝혔습니다.

Music v2는 ElevenMusic, ElevenAPI 및 ElevenCreative를 지원합니다. 개발자는 이 API를 통해 프로그래밍 방식으로 트랙을 생성하고, 인페인팅 기능을 사용하여 선택한 영역을 편집하며, 참조 매칭 기능을 활용할 수 있습니다.

모델 ID
music_v2
최대 기간
5분
공개된 API 요금
$ 0.15/분
오디오 출력
44.1 kHz
게시된 비트레이트
128–192 kbps
API 이용
유료 사용자
ElevenLabs 공식 ‘Introducing Music v2’ 출시 페이지
’ElevenLabs' 공식 Music v2 출시 페이지, 2026년 8월 확인.

ElevenLabs Music v2 테스트 결과

우리는 다음을 사용했습니다. 3회의 통제된 API 실행 90초라는 고정된 목표 시간을 설정했습니다. GPT는 당사 플랫폼에서 원본 가사 세트를 한 번 생성했으며, Music v2를 테스트하기 전에 이를 고정했습니다. 청취 기록은 Gemini 3.6 Flash 오디오 분석 결과와 교차 확인했습니다. 아래의 시간은 현지 기준 종단간 생성 시간이며, 요금은 완료된 작업에서 보고된 값입니다.

시험 1: 가사가 제공된 팝송

테스트 01가사가 제공된 팝송
90초 목표112 BPM미성년자알토 성부

작업 설정: 제공된 가사를 정확히 사용하여, 한밤중에 도시를 떠나는 두 사람을 주제로 한 현대적인 신스팝 곡을 만들어 주세요. 저희는 가사 전달도, 보컬의 명료함, 후크의 강도, 편곡, 그리고 요청된 마지막 화음을 중점적으로 평가했습니다.

복사 가능한 프롬프트 전체 표시
따뜻하고 표현력 풍부한 알토 리드 보컬이 돋보이는, 완전히 독창적인 90초 분량의 현대식 신스팝 곡을 하나 만들어 주세요. BPM은 112, 조는 A 단조로 설정하세요. 곡의 분위기는 희망적이고, 친밀하며, 영화 같은 느낌을 주어야 합니다. 뮤트 처리된 일렉트릭 피아노와 부드러운 아날로그 신스 비트로 시작하세요. 첫 번째 절에서는 둥글게 울리는 베이스와 타이트한 일렉트로닉 드럼을 추가하고, 프리코러스에서 긴장감을 고조시킨 뒤, 절제된 배경 하모니가 어우러진 넓고 기억에 남는 코러스로 이어지게 하세요. 리드 보컬은 선명하게 중앙에 위치하도록 하고, 악기 간의 분리감을 명확히 유지하세요. 말로 된 인트로, 랩, 군중 소리, 실제 아티스트의 모방, 페이드 아웃은 포함하지 마세요. 명확한 마지막 코드로 끝맺으세요.

아래의 가사를 정확히 따라 부르세요. 단어나 구절을 추가, 삭제, 대체하거나 순서를 바꾸지 마세요.

[1절]
우리 뒤로 도시의 불빛이 희미해져 가네
이제 고요한 거리가 길을 안내해
한밤중의 속삭임, 뒤를 돌아보지 않아
새로운 지평이 회색을 뚫고 나타난다
[프리 코러스]
손을 맞잡고, 우리는 미지의 길을 걷는다
우리만의 꿈이라 부르는 것을 쫓으며
[코러스]
우리는 고요한 밤 속에 살아 숨 쉬네
스카이라인 너머 별들을 찾아
그림자 속에 휩싸여도, 여전히 빛나네
함께, 우리는 새로운 의미를 찾아낼 거야
[2절]
텅 빈 길 위를 부드럽게 내딛는 발걸음
숨 쉴 때마다 이야기가 펼쳐져
약속은 없지만, 끝없이 펼쳐진 하늘만
네 눈 속에 미래가 깃들어 있어
[Final Chorus]
우리는 고요한 밤 속에서 살아 숨 쉬고 있어
스카이라인 너머 별들을 찾아가며
그림자 속에 휩싸여도, 여전히 빛나
함께, 우리는 새로운 의미를 찾아낼 거야
테스트 01 결과전자 음악으로 구성된 인트로가 더 길어졌으며, 가사의 일관성이 돋보입니다.
90.0초출력
42.0초생성 시간
$0.225업무 비용
  • 가사 내용에 뚜렷한 일탈이 없음 제공된 단어에서 해당 단어가 발견되었습니다.
  • 이 곡은 세련된 일렉트로닉 신스팝의 특색을 지녔으며, 보컬과 악기의 분리도가 매우 뛰어났다.
  • 보컬이 시작되기 전의 인트로가 요청된 시간보다 더 길게 느껴졌다.

테스트 2: 영화풍 기악곡

테스트 02영화풍 기악곡
90초 목표82 BPMD 단조보컬 없음

작업 설정: 눈에 띄는 펠트 피아노 모티프를 중심으로 SF 분위기의 큐를 구성하되, 오케스트라 사운드가 점차 고조되고, 마지막 3분의 1 구간에서만 금관악기가 등장하며, 사람의 목소리는 배제하고, 결말은 완결감 있게 마무리되도록 하십시오.

복사 가능한 프롬프트 전체 표시
극적인 SF 탐사 장면을 위한 완전히 독창적인 90초 분량의 영화적 기악곡을 하나 제작해 주세요. 82 BPM과 D 단조를 사용해 주십시오. 보컬, 대사, 속삭임, 합창, 또는 사람의 목소리와 유사한 소리는 사용해서는 안 됩니다. 희박한 느낌의 피아노 모티프와 낮은 음역의 지속되는 현악기로 조용하게 시작하십시오. 오프닝 이후 미묘한 아날로그 박동을 도입한 뒤, 겹쳐진 현악기와 절제된 저음 타악기를 통해 서서히 분위기를 고조시키십시오. 금관악기는 마지막 3분의 1 구간에만 추가하십시오. 과도한 음량이나 왜곡 없이 끝부분 근처에서 명확한 감정적 절정을 이끌어내십시오. 피아노 모티프가 명확하게 인식되도록 하고, 피아노, 현악기, 타악기, 신스 맥박, 금관악기 간의 명확한 분리감을 유지하십시오. 사실적인 오케스트라 음색을 사용하고, 공간감이 있으면서도 통제된 믹싱을 적용하십시오. 전반부에서는 트레일러 특유의 강렬한 임팩트 사운드를 피하십시오. 기존 악보, 작곡가, 또는 프랜차이즈를 모방하지 마십시오. 페이드아웃 대신 해결된 지속 화음으로 끝맺으십시오.
테스트 02 결과설득력 있는 영화적 전개와 초반에 강렬한 인상을 남기는 장면 하나
90.0초출력
20.9초생성 시간
$0.225업무 비용
  • 음성 같은 질감이 없음 이 감지되었습니다.
  • 피아노 모티프를 중심으로 편곡이 전개되면서도 그 모티프는 여전히 알아볼 수 있었다.
  • 예정된 시간보다 일찍 충격이 가해지면서, 엄격한 시간 준수가 약화되었다.

시험 3: 8부 합창곡 구조

테스트 038부 합창 구조
90초 목표104 BPMD 장조섹션 순서 수정

작업 설정: ‘인트로’, ‘버스’, ‘프리 코러스’, ‘코러스’, ‘인스트루멘탈 브레이크’, ‘브릿지’, ‘파이널 코러스’, ‘아웃트로’의 8가지 구간이 정해진 순서대로 명확하게 구분되는 얼터너티브 팝 곡을 작곡하세요.

복사 가능한 프롬프트 전체 표시
명확하고 표현력 있는 테너 리드 보컬이 돋보이는, 완전히 독창적인 90초 분량의 얼터너티브 팝 곡을 하나 제작하십시오. 104 BPM과 D 장조를 사용하며, 현대적인 얼터너티브 팝 프로덕션 스타일, 자연스러운 발음, 절제된 보컬 이펙트를 적용하십시오. 내레이션, 랩, 실제 아티스트의 모방, 페이드 아웃은 포함하지 마십시오. 정확히 이 순서대로 구성을 유지하고, 모든 프로덕션 변경 사항이 뚜렷하게 들리도록 하십시오: 인트로—약 6초, 필터링된 일렉트릭 기타와 멀리서 들리는 신스만 사용; 절—드라이 베이스와 림 클릭 퍼커션 추가; 프리 코러스—전체 드럼 없이 상승하는 패드 추가; 코러스—전체 드럼, 더 넓게 펼쳐지는 신스, 그리고 선명한 멜로디 후크 도입; 인스트루멘탈 브레이크—약 8초, 보컬 없이 코러스 멜로디를 에코 처리; 브릿지—피아노와 가까이서 녹음된 친밀한 보컬로 축소; 피날레 코러스—풀 밴드 사운드를 복원하고, 백킹 하모니와 옥타브 기타 라인을 추가하며, 첫 번째 코러스보다 더 웅장하게 표현; 아웃트로—드럼을 제거하고, 필터링된 기타 사운드로 돌아간 뒤, 깔끔한 마지막 코드로 마무리한다.

아래 가사를 정확히 따라 부르십시오. 가사를 추가, 삭제, 대체, 순서 변경하거나, 괄호 안에 있는 악기 연주 지침을 가사로 부르지 마십시오.

[인트로]
(악기 연주)
[버스]
갈라진 다이얼이 부서진 선율을 윙윙거린다
손가락이 바랜 선을 따라간다
정전기 소리가 방을 채운다
얽힌 신호들 사이를 헤매며
[프리 코러스]
신호가 깜빡이고, 소리는 불분명해
깊이 있는 목소리를 기다리며
[코러스]
소음 속에서도 내 목소리가 들리나요?
멀리서 들려오는 부름, 아슬아슬한 선택
잡음이 사라지고, 더 선명한 목소리
꽉 붙잡아, 우리가 그 소음을 찾아낼 거야
[악기 연주 브레이크]
(악기 연주)
[브릿지]
부서진 빛 속의 연약한 희망
부드러운 메아리가 나를 끌어당겨
침묵 속에서, 네가 나타난다
[마지막 코러스]
소음 속에서도 내 목소리가 들리나요?
멀리서 들려오는 부름, 아슬아슬한 선택
잡음이 사라지고, 더 선명한 목소리
꽉 붙잡아, 우리가 그 소음을 찾아낼 거야
[아웃트로]
속삭임이 노래로 변해
우리는 마땅히 있어야 할 곳에 있어
테스트 03 결과가장 뚜렷한 구조적 결과이지만, 타이밍 제어는 완벽하지는 않다
90.0초출력
20.9초생성 시간
$0.225업무 비용
  • 8개 구역 모두 쉽게 식별할 수 있었다, 브릿지와 마지막 코러스의 대비가 뚜렷하다.
  • 기악 간주 부분이 요청된 8초보다 길게 이어졌다.
  • 결말은 프롬프트에 나온 깔끔한 마지막 화음보다는 페이드 아웃에 더 가까웠다.

세 가지 테스트가 보여주는 것

성과 분석 결과

3/3활용 가능한 결과물

모든 실행 결과, 광범위한 음악적 과제에 부합하는 재생 가능한 90초 분량의 파일이 생성되었습니다.

1가사 명확하게 전달

제공된 팝 가사는 청취 확인 결과 뚜렷한 편차가 나타나지 않았습니다.

8음성 재생 구간

정형화된 곡 구성 덕분에 요청된 모든 부분을 쉽게 파악할 수 있었다.

  • 보컬: 테스트 1에서 소리가 선명하고 중앙에 잘 위치해 있으며, 전자 배경음과도 명확하게 구분되었습니다.
  • 기악곡 작곡: 테스트 2에서 나타난 피아노 모티프와 절제된 전개는 이 모델이 보컬 팝 음악 이상의 장르도 소화할 수 있음을 보여주었다.
  • 프롬프트 제어: 전체적인 구조는 장면 단위의 타이밍보다 더 중요했지만, 서두, 전환, 클라이맥스, 결말 부분은 여전히 수동으로 검토할 필요가 있다.
  • 편집 부담: 세 가지 결과물 중 사용 불가능한 것은 없었지만, 테스트 2와 3은 본격적인 제작에 투입하기 위해서는 약간의 수정 작업이 필요할 것으로 보입니다.

효율성 분석 결과

90초씩 3회에 걸친 실행 시간
팝 보컬
42.0초
기악곡
20.9초
8절로 된 노래
20.9초

해당 지역의 평균 종단 간 생성 시간: 27.9초. 로컬 시간에는 요청 처리, 폴링 및 네트워크 지연 시간이 포함되며, 제공자 측의 지연 시간은 포함되지 않습니다.

  • 총 생산량: 세 개의 파일에 걸쳐 총 270초입니다.
  • 작업 보고 총 요금: $0.675.
  • 실행당 요금: $0.225를 90초 동안, 이는 공식 $0.15/분의 API 비율에 1.5분을 곱한 값과 같습니다.
  • 재방송 없음: 세 가지 작업 모두 첫 번째 녹음 시도에서 바로 사용할 수 있는 오디오를 만들어 냈습니다.

ElevenLabs Music v2 이용 방법

ElevenLabs를 통한 접속

  • 브라우저 기반 작곡을 하려면 ElevenMusic을 사용하세요.
  • 프로그래밍 방식으로 생성 및 편집하려면 ElevenAPI를 사용하세요.
  • 그리고 유료 사용자는 Music API를 이용할 수 있습니다.
  • 상업용 라이선스는 ‘스타터’ 요금제 및 그 이상의 요금제에 제공됩니다.

GlobalGPT를 통한 접속

  • 하나의 계정에서 Music v2를 다른 오디오 및 AI 모델과 함께 사용하세요.
  • 별도의 VPN이나 서비스 제공업체 설정이 필요하지 않습니다.
  • 단일 플랫폼의 유지 관리 비용은 여러 개의 독립형 구독 서비스보다 저렴할 수 있습니다.
  • 전체 툴 스택을 다시 구축하지 않고도 다른 모델로 전환할 수 있습니다.
GlobalGPT 오디오 생성기를 사용해 보세요

API 액세스 및 사용 가능한 제어 기능

공식 SDK는 다음을 통해 모델을 노출합니다. elevenlabs.music.compose 와 함께 model_id="music_v2". 기본 요청을 통해 자연어 프롬프트 그리고 음악_재생시간_ms. 작곡 계획은 더 정교한 악장 구성, 가사 타이밍, 그리고 편곡에 대한 통제력을 더해줍니다.

  • 세대: 주어진 프롬프트를 바탕으로 완성된 노래나 반주곡을 만들어 주세요.
  • 상세한 답변: 생성된 작품에 대한 추가 정보를 요청하십시오.
  • 스트리밍: 파일이 완전히 다운로드될 때까지 기다리지 않고 바로 오디오를 재생할 수 있습니다.
  • 인페인팅: 트랙 전체를 대체하는 대신 선택한 영역만 다시 생성합니다.
  • 참조 일치: 가능한 경우 참고 자료를 활용하여 한 세대를 이끌어 나간다.

저작권이 있는 아티스트, 노래 또는 보호 대상 가사를 언급하는 프롬프트는 다음을 유발할 수 있습니다. 잘못된 프롬프트 또는 부적절한 구성 계획 답변. 현역 예술가의 정확한 스타일을 묻기보다는 음악적 특징을 설명해 주세요.

API 요청 예시

파이썬 SDK모델: music_v2
import os
from elevenlabs import ElevenLabs, save

client = ElevenLabs(api_key=os.environ["ELEVENLABS_API_KEY"])

audio = client.music.compose(
    model_id="music_v2",
    prompt=(
 "펠트 피아노, "
 "저음 현악기, 서서히 고조되는 전개, 그리고 해결된 마지막 화음이 포함된 독창적인 영화 음악 스타일의 기악곡을 만들어 주세요."
    ),
    music_length_ms=90_000,
)

save(audio, "music-v2-test.mp3")

API 키는 스크립트 내부가 아닌 환경 변수에 저장하세요. 프로덕션 환경의 앱에서는 긴 트랙을 생성하기 전에 요청 로깅, 재시도 횟수 제한 및 명확한 비용 상한선을 설정하세요.

가격 및 테스트 비용

항목검증된 값그 의미는
공식 음악 API 요금분당 $0.15게시일: ElevenLabs API 요금 안내 페이지, 세금, 부과금 및 관세는 제외합니다.
최대 기간5분음악 요청 1건당 허용되는 최대 출력 길이.
90초 과제 과제$0.2251.5분 × $0.15; 완료된 각 테스트 과제에 대해 보고됨.
3개 시험의 합계$0.67590초 분량의 결과물 3개; 재제작 비용은 포함되지 않습니다.

테스트 기록에 나타난 단가는 공식 API 단가와 일치합니다. 여기서 GlobalGPT의 가치는 통합된 이용 권한과 별도의 구독 건수 감소에 있으며, Music v2의 분당 요금이 실제로 더 저렴하다는 것을 의미하지는 않습니다.

ElevenLabs Music v2 프롬프트 작성 방법

Music v2는 음악적 목표와 타협할 수 없는 제약 조건을 제안서에서 명확히 구분했을 때 가장 좋은 반응을 보였습니다. 프롬프트를 다음 순서대로 작성하세요:

1출력노래인지 기악곡인지, 그리고 재생 시간.
2뮤지컬 프레임장르, 분위기, 템포, 조, 보컬 유형.
3배치서두, 전개, 절정, 결말.
4우선순위 혼합보컬의 위치, 분리감, 음량, 그리고 공간감.
5제외 사항말도 없고, 음량 변화도 없고, 군중 소리도 없고, 목소리 질감도 없다.
6가사와 구성절 제목과 단어가 변경될 수 있는지 여부.

유용한 영어 음악 용어

용어나 설명어를 클릭하면 복사할 수 있습니다. 예시: 따뜻하고 친근감 넘치는 리드 보컬에 발음이 뚜렷하다.

01가사 - 첫 번째 팝송귀하가 지정한 가사 그대로를 사용한 오리지널 보컬 곡
03배경 음악동영상, 팟캐스트, 제품 시연 또는 카페
자세히 보기