122B의 지능을 10B의 비용으로, GPT-5급 성능을 조준하는 Qwen3.5 MoE 멀티모달 모델
멀티모달 텍스트 생성 (이미지 및 텍스트 입력 기반)122B (10B Activated)262K 컨텍스트apache-2.0
122B 파라미터 중 10B만 활성화하여 효율성을 극대화한 고성능 시각-언어 통합 모델입니다.
핵심 역량
- 122B 총 파라미터 중 10B 활성화로 고효율 추론 가능
- 최대 1,010,000 토큰의 초거대 컨텍스트 확장성 지원
- 이미지-텍스트 통합 학습을 통한 강력한 시각적 이해 및 추론
- 한국어를 포함한 201개 이상의 다국어 및 방언 지원
- Gated Delta Networks 기반의 하이브리드 아키텍처로 추론 가속화
알아두면 좋은 것
- MMLU-Pro(86.7), GPQA Diamond(86.6) 등 주요 벤치마크에서 GPT-5-mini급 성능 기록
- 한국어를 포함한 201개 언어 지원으로 뛰어난 문화적 맥락 이해력 확보
- vLLM, SGLang, KTransformers 등 주요 추론 프레임워크와 즉시 호환
- Apache-2.0 라이선스로 상업적 활용 및 자유로운 수정 배포 가능
416
Likes
281.9k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.