구글, Gemini와 API, Vids 전반에 Lyria 3.5 음악 AI 적용

뉴스 요약
구글이 최신 AI 음악 생성 모델인 Lyria 3.5를 Gemini 앱과 Gemini API에 배포하기 시작했으며, 이는 구글의 오디오 생성 기술 중 가장 광범위한 출시입니다. 2026년 9월 4일(태평양 표준시)에 발표된 이번 배포는 2026년 7월 29일 Google Flow Music에서 처음 선보인 모델을 확장한 것으로, 이제 전 세계 일반 사용자, 아티스트, 개발자 등 훨씬 더 많은 사용자에게 제공됩니다.
Lyria 3.5의 주요 기능
구글은 Lyria 3.5를 지금까지 출시된 자사 모델 중 음질이 가장 뛰어난 음악 생성 모델로 설명합니다. 이전 버전과 비교해 더욱 표현력 있는 보컬 퍼포먼스, 풍부한 악기 편곡, 전반적으로 향상된 오디오 충실도를 제공한다고 밝혔습니다. 출력물은 44.1 kHz 스테레오 오디오로 생성되며, 이는 일반적인 상업용 음악 발매 수준과 맞먹는 음질입니다. 또한 이 모델은 짧고 반복적인 루프 대신 여러 절, 후렴, 브리지를 포함할 수 있는 구조적으로 완성도 높은 곡을 만들도록 설계되었습니다.
트랙 길이는 조절 가능하며, 프롬프트에 따라 약 1분에서 최대 3분까지 생성할 수 있어 짧은 징글부터 본격적인 노래까지 다양한 용도에 유연하게 대응할 수 있습니다.
이용 가능한 서비스
이번 확장 배포는 여러 구글 제품에 동시에 적용됩니다:
- Gemini 앱 — 웹과 모바일 모두에서 이용할 수 있어 전 세계 Gemini 사용자가 해당 기능을 활용할 수 있습니다
- Gemini API — 개발자가 Google AI Studio를 통해 접근할 수 있으며, 서드파티 애플리케이션 및 워크플로우에 모델을 통합할 수 있습니다
- Google Flow Music — 7월에 Lyria가 처음 출시된 아티스트 및 뮤지션을 위한 창작 도구입니다
- Google Vids — Workspace 내 구글의 동영상 제작 도구로, 사용자가 동영상 프로젝트에 AI로 생성된 사운드트랙을 직접 추가할 수 있습니다
구글은 이 기능이 특정 지역이나 구독 등급에 국한되지 않고 전 세계 모든 Gemini 사용자에게 순차적으로 배포되고 있다고 밝혔습니다.
창작 제어 기능 및 활용 사례
Lyria 3.5는 생성되는 음악을 세밀하게 조정할 수 있는 여러 방법을 제공합니다. 사용자는 음악 장르를 선택하거나 설명하고, 보컬 또는 연주곡 출력 중 하나를 고를 수 있습니다. 또한 이미지 기반 음악 생성을 지원하여 사진을 업로드하면 시스템이 그 분위기나 내용에 영감을 받아 곡을 작곡합니다.
가사의 경우 사용자가 직접 작성하거나, 특정 주제나 소재를 지정해 모델에 가사 생성을 요청할 수 있습니다. 구글은 배경 음악, 생일 축하 노래, 맞춤 징글, 벨소리 등 자주 쓰이는 상황에 맞는 템플릿 기반 단축 기능도 추가하여 음악 지식이 없는 사람도 쉽게 도구를 활용할 수 있도록 했습니다.
개발자 측면에서 Gemini API 문서는 고정된 30초 클립을 생성하는 Lyria 3 Clip이라는 보조 옵션을 소개하고 있으며, 이는 더 길고 세밀한 조정이 가능한 기본 Lyria 3.5 모델과 함께 제공됩니다. 요청은 텍스트 프롬프트 형태나 텍스트와 최대 10개의 이미지를 결합한 멀티모달 입력 형태로 전송할 수 있고, 생성된 파일은 MP3 또는 WAV 형식으로 받을 수 있습니다.
안전성 및 콘텐츠 출처 확인
구글의 다른 생성형 미디어 모델과 마찬가지로, Lyria 3.5로 생성된 모든 트랙에는 오디오에 직접 삽입된 비가청 SynthID 워터마크가 포함됩니다. 이를 통해 나중에 클립의 출처를 확인할 수 있으며, 음질에 영향을 주지 않으면서 청취자, 플랫폼, 권리자가 AI 생성 음악과 사람이 녹음한 트랙을 구분하는 데 도움이 됩니다.
구글은 모델에 제출되는 모든 프롬프트에 안전 필터링도 적용합니다. Gemini API 문서에 따르면, 특정 아티스트의 목소리를 모방하거나 저작권이 있는 자료를 복제하려는 요청은 생성 전에 차단됩니다. 이 API는 단일 턴 생성 방식으로 설계되어, 사용자가 여러 차례의 교환을 통해 클립을 점진적으로 다듬는 것이 아니라 하나의 프롬프트로 완성된 트랙을 생성합니다. 또한 구글은 동일한 프롬프트를 두 번 사용하더라도 호출마다 결과가 달라질 수 있다고 안내합니다.
업계 동향
이번 출시는 실험적이거나 초대 전용 미리보기였던 생성형 오디오 도구를 주류 상용 제품으로 확대하는 AI 업계 전반의 흐름을 따르고 있습니다. 소비자용 채팅 앱, 전문 창작 스튜디오, 생산성 도구, 개발자 API에 Lyria 3.5를 동시에 제공함으로써, 구글은 음악 생성 기능을 단순한 독립형 신제품이 아닌 일상적 개인 사용, 전문 콘텐츠 제작, 서드파티 소프트웨어 통합을 아우르는 기능으로 자리매김하고 있습니다.
이번 배포에 대한 보도에서는 7월 Flow Music 미리보기에서 9월 확장으로 이어진 과정이 상당히 빠른 반복 개선을 보여준다고 평가했으며, 구글은 두 출시 사이의 한 달 남짓한 기간 동안 보컬 표현력과 편곡 복잡도에서 측정 가능한 향상이 있었다고 설명했습니다.