로컬에서 구동되는 GGUF 양자화 DiffusionGemma의 멀티모달 파이프라인
이미지 입력을 해석해 텍스트를 생성하거나 설명하는 멀티모달 텍스트 생성 태스크를 수행한다.26Bapache-2.0
GGUF 양자화된 26B 파라미터의 DiffusionGemma를 이용해 이미지 입력을 텍스트로 변환하는 멀티모달 모델이다.
핵심 역량
- 이미지 입력에 대한 텍스트 생성
- 멀티모달 텍스트 출력 및 해설
- 로컬 GGUF 양자화 기반 추론
- 이미지-텍스트 태스크를 위한 텍스트 생성
훈련 방식
google/diffusiongemma-26B-A4B-it 기반 GGUF 양자화로 로컬 추론 최적화가 적용되었고, 추가 파인튜닝 정보는 공개되지 않았다.
알아두면 좋은 것
- 라이선스: Apache-2.0
- base_model: google/diffusiongemma-26B-A4B-it
- 포맷: GGUF 양자화
- 태스크: image-text-to-text
324
Likes
233.4k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.