본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

ernie-research/NAVA

텍스트 기반 영상 및 오디오 생성5Bapache-2.0

Wan2.2-TI2V-5B를 기반으로 파인튜닝된 영상 생성 모델로, Flow Matching 및 MMDiT 아키텍처를 활용하여 텍스트로부터 고품질 영상 및 오디오를 생성함.

학습 방식 · Wan2.2-TI2V-5B 기반 파인튜닝 모델로, Flow Matching 및 MMDiT 아키텍처를 활용하여 학습됨.

핵심 포인트

  • Wan2.2-TI2V-5B 기반의 검증된 아키텍처 활용
  • Apache 2.0 라이선스로 상업적 활용 가능
  • 텍스트 기반 영상 생성
  • 텍스트 기반 오디오 생성

52

LIKES

137

DOWNLOADS

1 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.