Qwen3-8B 아키텍처를 채택한 Tencent의 8B급 고성능 멀티모달 모델 Penguin-VL
멀티모달 텍스트 생성 및 이미지 이해8Bapache-2.0
Qwen3-8B 모델에 시각 인코더를 결합하여 이미지 이해와 텍스트 생성을 동시에 수행하는 멀티모달 모델이다.
핵심 역량
- 8B 파라미터 규모의 경량화된 멀티모달 추론
- Qwen3-8B 기반의 고성능 언어 생성 능력
- 이미지 입력을 지원하는 비전 인코더 통합 아키텍처
- Apache-2.0 라이선스 기반의 상업적 이용 지원
알아두면 좋은 것
- Qwen/Qwen3-8B를 베이스 모델로 활용하여 언어 모델 성능 확보
- 비전 인코더(Vision Encoder)를 통한 멀티모달 데이터 처리 구현
- Apache-2.0 오픈소스 라이선스 적용
- Tencent에서 공개한 8B 규모의 효율적인 VLM
65
Likes
3.2k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.