Vocal Directions
보컬 지시 태그
괄호로 묶인 태그([cheerful], [whisper])를 통해 TTS 출력의 억양·감정·발화 속도와 같은 프로소디 특성을 조절하는 기법으로, 입력 텍스트에 태그를 삽입하면 모델이 해당 태그에 대응하는 음성 특성을 생성해 사용자 의도에 맞춘 음성 연출이 가능하다.
보컬 지시 태그
괄호로 묶인 태그([cheerful], [whisper])를 통해 TTS 출력의 억양·감정·발화 속도와 같은 프로소디 특성을 조절하는 기법으로, 입력 텍스트에 태그를 삽입하면 모델이 해당 태그에 대응하는 음성 특성을 생성해 사용자 의도에 맞춘 음성 연출이 가능하다.