APIMart
Lyria 3.5의 표현력 풍부한 보컬과 더 긴 곡

Lyria 3.5의 표현력 풍부한 보컬과 더 긴 곡

Google Flow Music의 Lyria 3.5를 살펴봅니다. 표현력 있는 보컬, 더 선명한 가사, 184초 트랙, 구조화된 프롬프트, API 접근 방식과 워크플로 제한을 알아보세요.

모델 분석

한 문장으로 요약한다면, Lyria 3.5는 더 선명한 노래와 향상된 가사 전달력, 그리고 최대 184초 동안 일관성을 유지하는 곡이 필요할 때 가장 유용해 보입니다.

간단히 정리하면 다음과 같습니다.

  • 보컬이 핵심 업데이트로 보입니다. 음색, 감정, 호흡 제어, 그리고 가수가 처음부터 끝까지 안정적으로 노래하는지를 확인해야 합니다.
  • 이제 길이가 더 중요해졌습니다. 모델은 최대 3분 4초의 트랙을 처리할 수 있으므로, 강렬한 첫 20초뿐 아니라 전체 곡의 흐름을 테스트해야 합니다.
  • 구조는 프롬프트로 이끕니다. [Verse], [Chorus], [Bridge] 같은 태그와 타임스탬프가 곡의 형태를 잡는 데 도움이 됩니다.
  • 언어 지원 범위가 넓습니다. 영어, 독일어, 스페인어, 프랑스어, 힌디어, 일본어, 한국어, 포르투갈어의 8개 언어에 맞춰 발음이 최적화되었습니다.
  • 워크플로 제한이 명확합니다. 멀티턴 편집을 지원하지 않으므로 각 결과는 단일 생성으로 완성됩니다. 더 나은 결과가 필요하면 프롬프트를 다시 실행해야 합니다.
  • 적합한 사용 사례가 분명합니다. 광고에는 명확한 훅이, 게임에는 안정적인 반복 구간이, 교육에는 또렷한 단어가 필요하며, 크리에이터 팀에는 초안에서 완성본까지 빠르게 이어지는 흐름이 필요합니다.

사용 여부를 결정하고 있다면 테스트는 단순하게 유지하는 것이 좋습니다. 보컬이 자연스러움을 유지하는가? 곡이 184초 동안 흐름을 유지하는가? 팀이 긴 후처리 과정 없이 결과물을 활용할 수 있는가?

Lyria 3 Clip과 Lyria 3.5 Pro의 주요 차이 한눈에 보기
Lyria 3 Clip과 Lyria 3.5 Pro의 주요 차이 한눈에 보기

Google DeepMind, Flow Music에 Lyria 3.5 출시

Google DeepMind

빠른 비교

모델최대 길이주요 용도구조 제어가장 적합한 용도
Lyria 3 Clip30초짧은 음악 아이디어기본소셜 클립, 광고용 짧은 음악, 초기 프롬프트 테스트
Lyria 3.5 / Pro184초한 곡 길이의 결과물구간 태그 + 타임스탬프광고, 게임, 교육, 더 긴 크리에이터 트랙

Lyria 3.5의 핵심은 “새로운 기능”보다는 하나의 명확한 질문에 있다고 봅니다. 짧은 데모에서 실제로 게시하거나 배포할 수 있는 트랙으로 넘어갈 때 시간을 절약해 주는가?

표현력 있는 보컬에서 달라진 점과 차이를 판단하는 방법

Google DeepMind는 Lyria 3.5가 음악성, 가사, 보컬 품질을 개선한다고 설명합니다 [1]. 실제로 중요한 점은 더 단순합니다. 실제로 무엇이 들리는지, 그리고 직접 무엇을 확인할 수 있는지입니다.

보컬의 사실감, 강약, 감정 표현

처음 몇 소절뿐 아니라 _트랙 전체_를 들어보는 것부터 시작하세요. 핵심 테스트는 한 프레이즈에서 다음 프레이즈로 넘어갈 때 목소리가 자연스러움을 유지하는지입니다. Lyria 3.5는 숨소리가 섞인 벌스, 부드러운 코러스, 가벼운 하모니 등 더 섬세한 표현을 지원합니다 [1]. 이런 디테일은 곡이 평면적이고 기계적으로 들리지 않고 풍부한 표현력을 갖게 해 줍니다.

이를 테스트하는 좋은 방법은 "breathy", "raspy", "airy," 또는 **"deep baritone"**처럼 음색을 직접 지정하는 프롬프트를 사용하는 것입니다 [4]. 그런 다음 주의 깊게 들어보세요. 그 보컬 질감이 곡 전체에서 안정적으로 유지되나요? 프레이즈의 끝이 자연스럽게 마무리되나요, 아니면 잘리거나 어색하게 들리나요? 그다음 더 긴 편곡으로 확장해 보컬 품질 향상이 여전히 유지되는지 확인하세요.

생성된 곡의 발음과 가사 명료도

광고 징글과 브랜드 콘텐츠에서는 가사 전달력이 선택 사항이 아닙니다. 사람들이 단어를 알아들을 수 없다면 메시지는 전달되지 않습니다. Lyria 3.5는 밀도 높은 편곡에서도 보컬과 반주를 명확히 분리해 이 문제를 개선하는 것을 목표로 합니다 [1].

영어, 독일어, 스페인어, 프랑스어, 힌디어, 일본어, 한국어, 포르투갈어의 여덟 개 언어에 맞춰 발음이 최적화되어 있습니다 [5]. 국제 캠페인용 음악을 만든다면 대상 언어로 프롬프트를 작성하세요.

그런 다음 강도 높은 테스트를 진행하세요. 밀도 높은 믹스를 사용하고 보컬이 처음부터 끝까지 명확하게 들리는지 확인합니다. 이후 곡을 수분 길이의 트랙으로 확장해 다시 들어보세요. 중요한 것은 시작 부분에서 단어가 또렷한지뿐만 아니라, 편곡이 커져도 그 명료도가 계속 유지되는지입니다.

더 긴 컨텍스트에서 Lyria 3.5가 곡 구조를 처리하는 방법

짧은 클립에서 수분 길이의 곡 구조로

30초 클립에서 3분 트랙으로의 전환은 단순히 길이만 바꾸는 것이 아닙니다. 음악의 전체 형태가 달라집니다.

짧은 클립은 일반적으로 루프나 한 구간의 미리 보기로 작동합니다. 반면 Lyria 3.5는 최대 184초의 단일 생성 안에서 인트로, 벌스, 코러스, 브리지, 아웃트로로 구성된 완전한 곡 구조를 처리할 수 있습니다 [5]. 따라서 핵심 테스트는 모델이 단순히 계속 음악을 생성할 수 있는지가 아닙니다. 첫 구간이 끝난 뒤에도 곡이 계획된 것처럼 들리는지가 중요합니다.

Google에 따르면 모델은 오디오를 생성하기 전에 곡 구조를 계획하며, 이를 통해 전환의 일관성을 유지합니다 [2].

프롬프트에서 [Verse], [Chorus], [Bridge], [Intro], [Outro] 같은 구간 태그로 구조를 안내할 수 있습니다. [0:50 - 1:10] Chorus처럼 대괄호로 감싼 타임스탬프도 추가할 수 있습니다. 이런 지시는 전체 트랙에서 구간 전환을 명확하게 지정하는 데 도움이 됩니다.

모델대략적인 최대 길이구간 처리연속성의 강점가장 적합한 워크플로 유형
Lyria 3 Clip30초 [5]기본(루프/미리 보기)빠른 반복 작업, 일관된 단기 리듬소셜 미디어 클립, 광고용 짧은 음악, UI 효과음
Lyria 3.5 / Pro184초(3분) [5]고급(벌스, 코러스, 브리지, 아웃트로)구조 추론, 타임스탬프 기반 전환, 안정적인 악기 구성전체 곡 제작, 게임 사운드트랙, 교육

다음으로 확인할 것은 단순합니다. 편곡이 움직이기 시작한 뒤에도 이러한 구조 지시가 유지되는가?

실제 결과물에서 연속성이 나타나는 방식

트랙이 길다고 해서 자동으로 일관성이 생기는 것은 아닙니다. 실제 테스트는 모델이 템포와 조성을 안정적으로 유지하고, 모티프를 자연스럽게 다시 제시하며, 무작위로 들리지 않게 구간 사이를 전환할 수 있는지 확인하는 것입니다.

Lyria 3.5는 시작 단계에서 템포와 조성을 설정할 수 있어 이런 부분을 개선합니다. 즉, 피아노 독주 인트로가 현악기가 포함된 더 큰 편곡으로 발전하더라도 같은 멜로디 아이디어를 유지할 수 있으며, 중간에 전혀 다른 방향으로 벗어나지 않습니다.

Lyria 3.5로 전환하고 구간 태그, 타임스탬프, 템포, 조성이 포함된 구조화 프롬프트를 사용할 때는 다음 항목을 구체적으로 들어보세요.

  • 편곡이 논리적인 방식으로 전개되는가?
  • 전환이 매끄럽게 마무리되는가?
  • 요청하지 않은 반복을 피하는가?

긴 컨텍스트는 모티프, 템포, 전환이 곡 전체에서 안정적으로 유지될 때만 의미가 있습니다. 그 구조가 유지된다면 모델은 장시간 오디오가 필요한 프로덕션 사용 사례에 적합합니다.

워크플로, 도구, 통합 제약

사용 사례로 보는 광고, 게임, 교육, 크리에이터 제작

보컬과 곡 구조가 안정적으로 느껴진다면 다음 단계는 단순합니다. Lyria 3.5가 팀의 기존 작업 방식에 맞는가? 이는 작업의 성격에 따라 크게 달라집니다. 광고에는 정확한 타이밍이, 게임에는 연속성이, 교육에는 명확한 발음이 필요합니다. 크리에이터 팀은 빠른 진행 자체가 가장 중요할 때가 많습니다.

광고 징글은 보컬 표현과 구조에 가장 큰 부담을 줍니다. 짧은 광고에는 훅이 늦게 등장하거나 어색하게 마무리될 여유가 없습니다. 핵심 테스트는 광고 길이 안에서 훅이 정확하게 전달되는지입니다.

게임 사운드트랙에는 부드러운 루프와 긴 구간에 걸쳐 유지되는 안정적인 분위기가 필요합니다. 한 구간이 반복된다면 두 번째나 세 번째 재생에서 흐트러지거나 어색하게 느껴져서는 안 됩니다. 적절한 프롬프트 설정이 이에 도움이 됩니다. 고정 BPM, 조성, 악기 목록을 설정하면 여러 변형에서도 동일한 분위기를 더 쉽게 유지할 수 있습니다 [6].

교육용 오디오는 Lyria 3.5의 보컬 명료도 향상으로부터 가장 큰 이점을 얻습니다. 이 경우 화려한 편곡보다 명확한 발음이 더 중요합니다. 가사를 이해하기 어렵다면 학습 내용 전체가 무너집니다. 먼저 전달력을 테스트한 뒤 그 주변의 음악을 다듬으세요.

소셜 콘텐츠를 위한 크리에이터 워크플로에서는 완성도보다 속도를 더 중요하게 보는 경우가 많습니다. 실용적인 접근 방식은 빠른 초안으로 장르와 분위기를 테스트한 뒤, 아이디어가 확정되면 더 길고 품질 좋은 버전으로 옮겨가는 것입니다 [3][2].

현재 이용 경로와 팀에 미치는 의미

Lyria 3.5는 Google Flow Music, Gemini 앱, Dream Track을 통한 YouTube Shorts, Google Vids에서 이용할 수 있습니다. 개발자는 Google AI Studio와 Interactions API를 사용하는 Gemini API를 통해 접근할 수 있습니다 [1][4][3].

초기에 알아둘 만한 제한이 하나 있습니다. Lyria 3.5는 멀티턴 편집을 지원하지 않습니다. 각 결과물은 첫 프롬프트에서 단번에 생성됩니다 [3][2]. 따라서 클립이 기대에 미치지 못해도 동일한 클립을 단계별로 수정할 수 없습니다. 다시 프롬프트를 입력해 새 결과물을 생성해야 합니다.

이는 팀이 파이프라인을 구성하는 방식에 영향을 줍니다. 주고받는 편집 과정을 중심으로 계획하는 대신, 각 프롬프트에서 여러 변형을 생성하고 가장 좋은 결과를 선택하는 편이 더 합리적입니다. DAW에서 하나의 세션을 편집하는 방식보다는 여러 테이크를 실행한 뒤 적합한 하나를 선택하는 방식에 가깝습니다.

API 접근에는 표준 generateContent 메서드 대신 Interactions API 사용이 권장됩니다. 이 API는 텍스트와 최대 10개 이미지를 포함한 멀티모달 입력을 지원하며, 프로덕션 환경의 장시간 음악 생성 작업을 위해 설계되었습니다 [6][2].

멀티모델 프로덕션 파이프라인에서 APIMart를 활용하는 방법

GccAi

이 단계에서는 통합 설계가 모델 결과물만큼 중요합니다.

음악 생성이 프로덕션 워크플로의 유일한 작업인 경우는 거의 없습니다. 60초 광고에는 대본, 보이스오버, 시각 자료, 음악 트랙이 동시에 필요할 수 있으며, 이후 이를 하나로 결합해야 합니다. APIMart는 단일 OpenAI 호환 API를 통해 500+ AI 모델에 접근할 수 있도록 지원하므로, 팀은 여러 통합을 따로 관리하지 않고도 Lyria 3.5와 언어, 이미지, 영상 작업을 함께 운영할 수 있습니다 [website].

이를 통해 청구를 단순화하고 도구 전환에 따른 부담을 줄일 수 있습니다. 핵심 테스트는 하나의 API가 라우팅, 검토, 인계에 드는 시간을 줄이는지 확인하는 것입니다.

결론과 Lyria 3.5를 평가하는 실용적 기준

Lyria 3.5 평가는 두 가지 간단한 확인으로 귀결됩니다. 보컬이 더 생생하고 감정 표현이 풍부하게 들리는가, 그리고 더 긴 컨텍스트에서도 최대 184초 동안 음악이 안정적이고 일관되게 유지되는가? 둘 다 그렇다면 다음 단계에서는 워크플로 적합성, 접근 방식, 내보내기 처리를 확인해야 합니다.

음색 테스트에는 "Airy Female Soprano", "Deep Male Baritone", "Raspy Rocker" 같은 프롬프트를 사용한 뒤 프로젝트에 필요한 언어에서 가사 명료도를 검토하세요 [4][5].

구간 태그와 타임스탬프를 사용해 184초 전체 재생 동안 구조가 유지되는지 확인하세요 [2]. 이 단계에서 구조가 무너진다면 모델은 프로덕션에 적합하지 않습니다. 184초 전체 재생의 중간 지점에서 분위기가 흐트러지거나 템포를 벗어나는 트랙은 첫 30초가 아무리 훌륭해도 프로덕션에 사용할 준비가 되지 않은 것입니다.

내부 테스트에서 확인해야 할 핵심 사항

Lyria 3.5를 다음 세 가지 영역에서 테스트하세요.

  • 보컬: 광고, 교육용 오디오, 내러티브 중심 크리에이터 콘텐츠처럼 가사와 감정이 핵심 역할을 할 때 가장 중요합니다.
  • 연속성: 게임 사운드트랙, 광고 징글, 기타 장시간 음악 작업처럼 트랙이 방향을 잃지 않고 구조를 유지해야 할 때 가장 중요합니다.
  • 워크플로 적합성: API 접근이 필요한지, MP3 또는 WAV 내보내기가 필요한지, 결과물이 미디어 파이프라인에 얼마나 원활하게 들어가는지라는 세 가지 실질적인 확인으로 결정됩니다.

Lyria 3.5 Pro 전체 생성을 실행하기 전에 Lyria 3 Clip으로 프롬프트를 다듬으세요.

자주 묻는 질문

보컬 품질은 어떻게 테스트해야 하나요?

프롬프트에서 성별, 질감, 음역처럼 명확한 보컬 특성을 정의하세요. 예를 들어 an airy female soprano 또는 _a raspy rocker_를 요청할 수 있습니다. 그런 다음 보컬이 원하는 사운드와 일치할 때까지 세부 사항을 계속 조정하세요.

먼저 더 빠른 미리 보기 모델로 시작하는 것이 좋습니다. 시간을 낭비하지 않고 여러 보컬 프롬프트를 테스트할 수 있으며, 적합한 목소리를 찾은 뒤 전체 길이의 곡으로 넘어갈 수 있습니다.

Lyria 3.5로 전체 곡을 만들 수 있나요?

네. Lyria 3.5는 Pro 모델로 전체 길이의 곡을 생성할 수 있습니다. 벌스, 코러스, 브리지 같은 구간이 포함된 최대 3분 길이의 완전한 트랙을 만들 수 있습니다.

Clip 모델은 30초 구간으로 제한됩니다. 텍스트 프롬프트나 구조 태그로 안내할 때 Pro는 곡 길이와 음악 흐름을 더 세밀하게 제어할 수 있습니다.

주요 워크플로 제한은 무엇인가요?

Lyria 3.5에는 계획에 반영해야 할 몇 가지 워크플로 제한이 있습니다.

  • 싱글턴 생성만 지원합니다. 즉, 프롬프트를 주고받으며 동일한 클립을 계속 다듬을 수 없습니다.
  • 프롬프트당 오디오 클립 하나를 생성하며 최대 길이는 184초입니다.
  • 안전 필터는 특정 아티스트의 목소리저작권이 있는 가사에 대한 요청을 차단합니다.

API 제한도 고려해야 합니다. 기본 모델당 분당 10회의 리전 온라인 예측 요청이 허용됩니다.

이제 직접 테스트해 보세요

모델 마켓에서 원하는 모델을 선택하세요

APIMart 모델 마켓에서 채팅, 이미지, 비디오 모델을 사용해 보고 하나의 통합 API로 모델 기능을 빠르게 경험하세요.

채팅 모델이미지 모델비디오 모델
모델 마켓 보기