단 한 번의 샘플로 미지의 목소리를 노래하게 만들다, 혁신적인 제로샷 SVS 모델
가창 음성 합성 (Singing Voice Synthesis, SVS)apache-2.0
멜로디와 악보 정보를 바탕으로 미학습 화자의 고품질 가창 음성을 생성하는 제로샷 SVS 모델입니다.
핵심 역량
- 제로샷 화자 복제 (Zero-shot Voice Cloning)
- F0 컨투어 기반 멜로디 제어
- MIDI 기반 악보 조건부 생성
- 영어 및 중국어 다국어 지원
- 고해상도 가창 음성 합성
알아두면 좋은 것
- arXiv:2602.07803 논문 기반의 최신 SVS 기술 적용
- Apache 2.0 라이선스로 학술 및 상업적 활용 가능
- F0 및 MIDI를 통한 정교한 피치/리듬 제어 지원
- 영어(en)와 중국어(zh) 데이터셋 학습
130
Likes
1.2k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.