무슨 일인가요
Google은 9월 3일 Gemini API 변경 로그에 Lyria 3.5를 공개 프리뷰로 올렸고, 다음 날인 9월 4일 Gemini 웹·모바일 앱에서 전 세계 사용자에게 제공한다고 알렸습니다. 공식 변경 로그의 설명은 "개선된 음악적 일관성, 자연스러운 보컬, 세밀한 길이·구조 제어를 갖춘 풀렝스 곡 생성"이며, 텍스트와 이미지를 입력받아 44.1kHz 고음질 스테레오 오디오를 만듭니다. 공식 Google DeepMind 모델 페이지는 최대 3분 길이를 명시하고, "60초 클립, 절반 길이 트랙, 3분짜리 풀 곡"처럼 프로젝트에 맞는 길이로 만들 수 있다고 설명합니다. 공식

Gemini 앱 쪽 글은 "더 표현력 있는 보컬과 더 풍부한 편곡"을 내세우고, 장르 선택, 보컬 또는 연주곡, 템플릿, 짧은 길이와 긴 길이 선택을 안내합니다. 공식 같은 모델이 Google Flow Music, Google AI Studio, Google Workspace Vids에도 들어갑니다. 공식
가격과 API 조건
| 모델 ID | 길이 | 상태 | 가격(곡당) |
|---|---|---|---|
| lyria-3-clip-preview | 30초 | 프리뷰(레거시) | $0.04 |
| lyria-3-pro-preview | 풀 곡 | 프리뷰(레거시) | $0.08 |
| lyria-3.5 | 최대 3분, 프롬프트로 조절 | 공개 프리뷰 | $0.08 |
가격 페이지는 lyria-3.5를 유료 등급 전용, 곡당 $0.08로 표기하고 Lyria 3 계열은 "레거시 음악 생성 모델"로 분류합니다. 공식 과금 단위가 초가 아니라 요청(곡)이라, 3분짜리 곡도 30초 클립의 두 배 값이면 됩니다. 공식
문서에 따르면 한 요청에 이미지를 10장까지 함께 넣을 수 있고, 가사는 [Verse] [Chorus] [Bridge] 같은 섹션 태그로, 구간은 [0:00-0:10] 같은 타임스탬프로 지정합니다. 공식 출력은 기본 MP3이고 WAV를 고를 수 있으며, 가사는 프롬프트에 쓴 언어로 생성되고 보컬 없는 연주곡도 만들 수 있습니다. 공식
제한 사항
문서에 적힌 제한
한 번에 한 곡, 고쳐 쓰기는 안 됩니다
단일 턴: 만든 곡을 이어서 수정하는 반복 편집은 지원하지 않습니다
같은 프롬프트라도 호출마다 결과가 달라질 수 있습니다
저작권 있는 콘텐츠나 특정 아티스트 목소리를 요구하면 필터가 차단합니다
생성된 모든 오디오에 SynthID 오디오 워터마크가 들어갑니다
출처: Gemini API music generation 문서, Google DeepMind Lyria 모델 페이지
DeepMind는 "모든 트랙에 감지되지 않는 SynthID 워터마크가 들어가 AI로 만들거나 편집한 음악인지 판별할 수 있다"고 설명하고, 데이터셋 필터링과 라벨링으로 유해한 가사가 나올 가능성을 줄였다고 밝혔습니다. 공식
무엇을 보면 되나요
- 창작자·마케터: Gemini 앱에서 바로 써 볼 수 있습니다. 브랜드 징글, 영상 배경음, 개인화된 벨소리가 Google이 든 용례입니다. 공식
- 개발자:
lyria-3.5를 인터랙션 API로 호출하며, 유료 등급이어야 합니다. 곡당 정액이므로 100곡을 만들어도 $8입니다. 추정 - 지켜볼 것: 공개 프리뷰가 정식 출시로 바뀌는 시점과 그때의 가격, 반복 편집 지원 여부.



