35B 전체 파라미터 중 3B만 활성화하여 효율을 높인 Qwen 3.5 멀티모달 모델
이미지 및 텍스트 입력을 통한 멀티모달 텍스트 생성35Bapache-2.0
이미지와 텍스트를 동시에 처리하는 MoE 구조의 35B 규모 멀티모달 모델로, 낮은 연산 비용으로 고성능 시각 추론을 수행한다.
핵심 역량
- 이미지 내용 설명 및 질의응답
- 복합 이미지-텍스트 추론
- 멀티턴 대화 수행
- 텍스트 기반 지시 이행
강점
- 35B 규모임에도 MoE를 통한 낮은 추론 지연 시간
- 이미지 이해와 텍스트 생성의 유기적 결합
- Apache 2.0 라이선스 기반의 개방형 생태계 지원
훈련 방식
Qwen 3.5 35B MoE Base 모델 기반의 멀티모달 인스트럭션 파인튜닝
알아두면 좋은 것
- 한국어를 포함한 다국어 지원 가능성
- 이미지-텍스트 간의 정렬된 표현 학습
- Transformers 프레임워크를 통한 간편한 통합
- 상업적 이용이 가능한 관대한 라이선스 정책
1.3k
Likes
3M
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.