본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

HiDream-ai/HiDream-O1-Image-Dev

이미지 및 텍스트 기반 이미지 생성mit

Qwen2-VL 아키텍처를 기반으로 텍스트와 이미지 입력을 결합하여 고품질 이미지를 생성하고 편집하는 멀티모달 모델이다.

학습 방식 · Qwen2-VL 기반의 이미지-텍스트 정렬 및 이미지 생성 특화 파인튜닝

핵심 포인트

  • MIT 라이선스로 자유로운 활용 가능
  • Qwen2-VL의 강력한 시각 이해 능력을 이미지 생성 태스크에 접목
  • 이미지 기반 이미지 생성
  • 텍스트 지시어 기반 이미지 편집

100

LIKES

4.3k

DOWNLOADS

1 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.