90억 파라미터로 이미지와 텍스트를 통합 이해하는 Apache 2.0 기반 Qwen 3.5 9B
멀티모달 텍스트 생성9Bapache-2.0
이미지와 텍스트 입력을 동시에 이해하고 대화할 수 있는 9B 규모의 고성능 멀티모달 언어 모델이다.
핵심 역량
- 이미지 내용 상세 설명 및 분석
- 시각적 질의응답(VQA) 수행
- 이미지 내 텍스트 인식 및 해석
- 멀티턴 멀티모달 대화
강점
- 9B 파라미터급 모델 중 최상위권의 멀티모달 이해 성능
- Apache 2.0 라이선스로 인한 상업적 이용의 편의성
- 300만 회 이상의 다운로드로 검증된 생태계 지원
훈련 방식
Qwen 3.5 9B-Base 기반의 지도 학습(SFT) 및 멀티모달 데이터셋 정렬 학습
알아두면 좋은 것
- Apache 2.0 라이선스를 적용하여 상업적 목적의 자유로운 활용 가능
- Qwen 3.5 9B-Base 모델을 기반으로 한 지도 학습(SFT) 파인튜닝 모델
- Transformers 라이브러리와의 높은 호환성으로 즉각적인 배포 지원
- 이미지-텍스트 간의 정렬 학습을 통한 높은 시각적 추론 정확도
1.3k
Likes
6.6M
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.