HiDream-ai/HiDream-O1-Image
이미지 및 텍스트 기반 이미지 생성 및 편집mit
Qwen-VL 아키텍처를 기반으로 이미지와 텍스트 입력을 결합하여 정교한 이미지를 생성하고 편집하는 멀티모달 모델이다.
학습 방식 · Qwen-VL 기반의 아키텍처를 활용하여 이미지와 텍스트 간의 정렬을 학습한 멀티모달 파인튜닝 모델
핵심 포인트
- MIT 라이선스로 자유로운 상업적 활용 가능
- Qwen-VL의 강력한 시각 이해 능력을 이미지 생성에 접목
- 이미지 기반 이미지 생성
- 텍스트 지시문을 통한 이미지 편집
427
LIKES
24.9k
DOWNLOADS
4 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.