27B 규모로 100B급 성능 압도, FP8 양자화로 실용성까지 더한 Qwen3.5
이미지 및 텍스트 기반 대화 및 추론27B262K 컨텍스트apache-2.0
시각과 언어를 통합한 하이브리드 구조에 FP8 양자화를 적용하여 성능과 효율을 모두 잡은 27B 멀티모달 모델입니다.
핵심 역량
- FP8 정밀도 양자화 (성능 저하 최소화)
- 262K 토큰 기본 컨텍스트 (최대 1M 확장)
- 201개 이상의 다국어 지원 (한국어 포함)
- Gated Delta Networks 기반 고효율 추론 아키텍처
- 시각-언어 통합 토큰 학습 (Early Fusion)
알아두면 좋은 것
- IFEval 95.0점, MMLU-Pro 86.1점으로 대형 모델급 성능 기록
- FP8 양자화(블록 크기 128)로 원본 대비 성능 손실 거의 없음
- 한국어 포함 201개 언어 지원으로 글로벌 범용성 확보
- vLLM, SGLang, KTransformers 등 다양한 런타임 지원
96
Likes
254.4k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.