섹션별 상세
Google DeepMind의 최신 음악 생성 모델인 Lyria 3가 Gemini 앱에 베타 버전으로 출시됐다. 사용자는 텍스트 프롬프트나 사진을 입력하여 30초 분량의 고품질 트랙을 생성할 수 있으며, Nano Banana 모델이 생성한 맞춤형 커버 아트도 함께 제공받는다.
Lyria 3는 이전 모델 대비 세 가지 주요 개선 사항을 포함한다. 별도의 가사 입력 없이 프롬프트 기반으로 가사를 자동 생성하며, 스타일, 보컬, 템포에 대한 사용자 제어 권한이 강화됐다. 또한 더욱 현실적이고 음악적으로 복잡한 구조의 트랙 생성이 가능하다.
생성된 모든 오디오 트랙에는 Google의 SynthID 워터마크가 삽입된다. 이는 인간의 귀에는 들리지 않지만 기술적으로 식별 가능한 표식으로, Gemini 앱 내에서 파일 업로드를 통해 해당 오디오가 Google AI로 생성되었는지 여부를 확인할 수 있는 검증 기능을 지원한다.
책임감 있는 AI 개발을 위해 특정 아티스트의 목소리나 스타일을 그대로 모방하는 것을 제한한다. 특정 아티스트 이름을 입력할 경우 해당 스타일을 영감으로만 활용하며, 기존 콘텐츠와의 유사성을 체크하는 필터링 시스템을 가동하여 지식재산권을 보호한다.
용어 해설
- 신스ID(SynthID)
- — Google DeepMind가 개발한 워터마킹 기술이다. 오디오나 이미지에 인간이 인지할 수 없는 식별 정보를 삽입하여 AI 생성물임을 증명한다. 콘텐츠의 무결성을 확인하고 오남용을 방지하며 AI 생성물의 투명성을 높이는 데 필수적인 역할을 수행한다.
- 멀티모달(Multimodal)
- — 텍스트, 이미지, 오디오 등 서로 다른 형태의 데이터를 동시에 처리하고 이해하는 기술이다. 이 아티클에서는 사진을 분석하여 그 분위기에 어울리는 음악을 생성하는 기능을 가능하게 하는 핵심 메커니즘으로 작용한다.
- 오디오 생성(Audio Generation)
- — 텍스트나 이미지 입력을 바탕으로 새로운 소리나 음악을 만들어내는 AI 기술이다. 단순한 소리 합성을 넘어 멜로디, 리듬, 가사, 보컬을 조화롭게 구성하여 완성도 있는 음악적 결과물을 도출하는 과정을 포함한다.
- 워터마킹(Watermarking)
- — 디지털 콘텐츠에 저작권 정보나 출처를 삽입하는 기법이다. AI 분야에서는 생성된 결과물이 인공지능에 의해 만들어졌음을 표시하여 딥페이크나 허위 정보 유포를 방지하고 콘텐츠의 신뢰성을 확보하는 도구로 활용된다.
기술
- Lyria 3
- Gemini
- SynthID
- Nano Banana
활용 사례
- 소셜 미디어용 배경 음악 생성
- 개인화된 음악 선물 제작
- 사진/비디오 분위기에 맞는 사운드트랙 구성
언급된 리소스
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 02. 19.수집 2026. 02. 21.출처 타입 RSS
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.