Comfy-Org/MiniMax-H3
비디오 생성(이미지→비디오, 텍스트→비디오, 레퍼런스→비디오)minimax-h3-community-license-agreement
여러 양자화·프루닝 변형을 포함한 MiniMax-H3 ComfyUI 배포
TL;DR
MiniMaxAI의 MiniMax-H3를 ComfyUI용으로 재패키지한 배포물로, diffusion_models·text_encoders·vae를 각각 여러 정밀도와 프루닝 변형으로 제공하고 I2V·T2V·R2V용 템플릿 링크를 포함하고 있습니다. 파일명에 bf16, int8_convrot, pruned_int8_convrot, pruned_fp8_scaled, nvfp4_awq 같은 정밀도 표기가 있어 메모리와 속도 측면의 선택지가 마련되어 있습니다. 설치는 README에 제시된 ComfyUI 폴더 구조대로 파일을 배치하면 되며 배포 라이선스는 minimax-h3-community-license-agreement입니다.
핵심 포인트
- ComfyUI용으로 재패키지된 MiniMax-H3 모델 모음으로, 원본은 MiniMaxAI/MiniMax-H3 리포지토리입니다. README에 제시된 폴더 구조는 ComfyUI 루트 아래 ComfyUI/models/diffusion_models, text_encoders, vae에 각각 파일을 배치하도록 요구합니다. 이 배치만 따르면 ComfyUI 템플릿과 바로 연결해 I2V·T2V·R2V 워크플로우 템플릿을 사용할 수 있습니다.
- diffusion_models와 text_encoders, vae가 여러 정밀도와 형태로 제공되어 선택적 사용이 가능합니다. diffusion_models 파일명에는 bf16, int8_convrot, pruned_int8_convrot, pruned_fp8_scaled 같은 서픽스가 포함되어 있고 text_encoders에는 qwen3vl_32b 기반의 bf16, int8_convrot, nvfp4_awq 변형이 포함되어 있습니다. 이러한 파일 구성은 사용자가 메모리·속도·정확도 트레이드오프를 고려해 적절한 정밀도와 프루닝 옵션을 골라 ComfyUI 파이프라인에 연결하도록 설계되어 있습니다.
- 오디오와 비디오 전용 VAE가 별도로 포함되어 있어 멀티모달 결과를 다루는 워크플로우를 지원합니다. README에 minimax_h3_audio_vae_fp32.safetensors와 minimax_h3_video_vae_fp16.safetensors가 명시되어 있고, 워크플로우 템플릿 링크가 I2V, T2V, R2V용으로 제공됩니다. 텍스트 인코더와 diffusion 모델, VAE가 모두 갖춰져 있기 때문에 ComfyUI 환경에서 입력(이미지/텍스트/레퍼런스)을 인코딩한 뒤 diffusion으로 잠재를 생성하고 VAE로 디코딩하는 일련의 파이프라인 구성이 가능해 보입니다.
- 라이선스는 minimax-h3-community-license-agreement로 표기되어 있으며 원문 라이선스 링크가 README에 포함되어 있습니다. 태그로 comfyui가 명시되어 있어 주 사용 환경이 ComfyUI임을 확인할 수 있습니다. 좋아요는 432회, 다운로드는 2회로 메타데이터가 함께 제공되어 있어 배포·사용 전에 라이선스 조건을 반드시 확인해야 합니다.
432
Likes
2
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.