MisoLabs에서 공개한 Llama 및 Mimi 기반의 새로운 음성 합성 모델 MisoTTS
텍스트 음성 변환other
MisoLabs에서 공개한 Llama 아키텍처와 Mimi 오디오 코덱을 활용한 텍스트 음성 변환(TTS) 모델입니다.
핵심 역량
- 텍스트 음성 변환
- 음성 합성
- 오디오 생성
훈련 방식
Llama 아키텍처와 Mimi 오디오 코덱을 결합한 텍스트 음성 변환 모델
알아두면 좋은 것
- Llama 아키텍처 기반 설계
- Mimi 오디오 코덱 활용
- PyTorch 프레임워크 지원
198
Likes
0
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.