AIMixer/ComfyUI_MiniMaxH3_Director
JavaScript0 / 0
ComfyUI MiniMax H3의 다중 장면 생성과 영상 편집을 한 감독 노드로 묶습니다.
TL;DR
이 레포는 ComfyUI 생태계에서 공식 MiniMax H3 영상 생성 노드를 확장하는 custom node 플러그인으로, 별도 앱이나 일반 JavaScript 라이브러리가 아닙니다. 하나의 감독 노드가 영상 분할, 장면별 프롬프트, t2v·i2v·fl2v·r2v·v2v·rv2v 입력, 샘플링, 생성 오디오와 최종 영상 내보내기를 묶어 긴 영상을 여러 구간으로 제작하게 합니다. 외부 Group 노드와 Refine 노드를 연결하면 소재 그룹을 배치로 공급하거나 SIGMAS 기반 재샘플링·확대·latent 확대를 추가할 수 있습니다. 반면 ComfyUI 0.30.0 이상과 공식 MiniMax H3 지원, 전용 UNET·Qwen3-VL CLIP·Video VAE·Audio VAE가 필요하므로 모델과 GPU 환경을 이미 갖춘 ComfyUI 사용자에게 적합합니다.
핵심 포인트
- 이 레포는 독립 실행형 앱이 아니라 공식 ComfyUI MiniMax H3 노드를 확장하는 custom node 플러그인입니다. MiniMaxH3ImageToVideo, MiniMaxH3ReferenceToVideo, MiniMaxH3SigmaShift, KSampler와 AV 분리 디코딩 흐름을 하나의 감독 노드에 연결합니다. ComfyUI에서 MiniMax H3 기반 장면을 여러 구간으로 제작하려는 경우에 맞습니다.
- 노드 내부에서 영상을 업로드한 뒤 직접 분할하거나 균등 분할하고 PySceneDetect로 장면을 나눌 수 있습니다. 각 구간에 프롬프트와 길이를 배정하고 선택한 구간만 샘플링하며 타임라인에서 구간 범위와 썸네일을 확인합니다. 여러 장면을 한 번에 생성하고 미선택 구간은 캐시나 원본 화면으로 채워 전체 영상을 내보낼 수 있습니다.
- t2v, i2v, fl2v, r2v, v2v, rv2v를 지원해 텍스트·이미지·첫뒤 프레임·참조 소재·원본 영상 기반 제작을 한 UI에서 처리합니다. r2v는 이미지 최대 9개, 영상 최대 3개, 오디오 최대 3개를 소재 그룹에 연결하고 `<Picture N>`, `<Video K>`, `<Audio J>` 또는 `@` 참조를 사용합니다. 생성 오디오를 화면과 함께 출력하며 v2v와 rv2v에서는 생성 음성, 원음, 무음을 선택할 수 있습니다.
- Refine 노드를 연결하면 동일 해상도 재샘플링, 목표 해상도 확대 후 재샘플링, H3 latent 확대를 선택할 수 있습니다. `passes`로 반복 횟수를 지정하고 `refine_model`과 SIGMAS를 외부 연결하며 `images`와 `images_pre_refine`로 최종 결과와 1차 결과를 분리합니다. 다만 ComfyUI 0.30.0 이상과 MiniMax H3 모델·UNET·CLIP·Video VAE·Audio VAE가 필요해 설치 전에 모델 구성을 준비해야 합니다.
이미지 분석

933
STARS
104
FORKS
+204
TRENDING
0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.