Wan2.2 기반의 고성능 영상 생성 모델 NAVA 공개
텍스트 기반 영상 및 오디오 생성5Bapache-2.0
Wan2.2-TI2V-5B를 기반으로 파인튜닝된 영상 생성 모델로, Flow Matching 및 MMDiT 아키텍처를 활용하여 텍스트로부터 고품질 영상 및 오디오를 생성함.
핵심 역량
- 텍스트 기반 영상 생성
- 텍스트 기반 오디오 생성
- 오디오-비디오 동기화 생성
강점
- Wan2.2-TI2V-5B 기반의 검증된 아키텍처 활용
- Apache 2.0 라이선스로 상업적 활용 가능
훈련 방식
Wan2.2-TI2V-5B 기반 파인튜닝 모델로, Flow Matching 및 MMDiT 아키텍처를 활용하여 학습됨.
알아두면 좋은 것
- Wan2.2-TI2V-5B 기반 파인튜닝 모델
- Flow Matching 아키텍처 적용
- Apache 2.0 라이선스 적용
52
Likes
137
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.