본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

fal/MiniMax-H3-Realism-People-LoRA

MiniMax H3의 text-to-video 결과에서 사실적인 인물 얼굴과 영화적 움직임을 강화하는 LoRA 어댑터입니다.minimax-h3-community-license

MiniMax H3의 인물 얼굴과 피부 질감, 표정, 영화적 움직임을 강화하는 LoRA입니다.

학습 방식 · MiniMax H3를 기반으로 fal H3 trainer에서 인물 중심 실사 클립 176개를 사용해 LoRA를 학습했으며, 16개 설정을 동일 프롬프트·seed로 비교해 rank 32·1500 steps·고해상도 버킷을 선택했습니다.

TL;DR

이 모델은 MiniMaxAI/MiniMax-H3를 기반으로 인물 표현을 강화한 LoRA 어댑터이며, text-to-video에서 `r34l1sm` 트리거를 사용합니다. 176개 실사 클립으로 얼굴, 피부 질감, 자연스러운 표정과 제스처, 영화적 조명 및 은은한 핸드헬드 움직임을 학습했습니다. 16개 설정을 동일 프롬프트와 seed로 비교한 뒤 rank 32, 1500 steps, 고해상도 학습 버킷을 채택했으며, README는 고해상도가 모공·잔머리·그레인 같은 고주파 질감 학습에 더 중요했다고 설명합니다. fal의 H3 LoRA endpoint에서 scale 1.0으로 적용하고, 0.6~0.8에서는 효과를 약하게 조정할 수 있습니다.

핵심 포인트

  • MiniMax H3에 인물 중심 학습을 더해 얼굴·피부·표정·손동작의 일관성을 높입니다.
  • 176개 실사 클립으로 학습해 피부 질감과 잔머리, 모공, 필름 그레인을 보존합니다.
  • 동일 프롬프트와 seed 비교에서 자연스러운 표정과 다큐멘터리풍 핸드헬드 움직임을 겨냥합니다.
  • rank 32·1500 steps·고해상도 학습 버킷 조합으로 공개 설정을 고정했습니다.

제한사항

  • 인물·초상·군중·일상 캐릭터에 초점을 둔 어댑터라 일반적인 장면이나 비인간 피사체의 개선 폭은 README에서 확인되지 않습니다.
  • 권장 LoRA scale은 1.0이며 0.6~0.8은 효과를 약하게 만드는 설정으로 안내되어 있어 사용 환경에 맞춘 조정이 필요합니다.

109

Likes

0

Downloads

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.