397B의 압도적 스케일을 17B의 효율로, 201개 언어를 지원하는 차세대 멀티모달 MoE
멀티모달 텍스트 생성 (이미지/텍스트 입력)397B (17B Activated)262K 컨텍스트apache-2.0
시각과 언어를 통합 학습한 397B 규모의 MoE 모델로, 17B 활성화 파라미터만으로 초고성능 멀티모달 추론을 수행합니다.
핵심 역량
- 397B 전체 파라미터 중 17B만 활성화하는 고효율 MoE 구조
- 기본 262K, 최대 101만(1M) 토큰까지 확장 가능한 컨텍스트 길이
- 한국어를 포함한 201개 이상의 글로벌 언어 및 방언 지원
- 시각-언어 통합 학습으로 이미지 기반 코딩 및 에이전트 작업 최적화
- FP8 정밀도 최적화를 통한 대규모 모델 추론 비용 및 지연 시간 절감
알아두면 좋은 것
- MMLU-Pro(87.8), IFBench(76.5) 등 주요 벤치마크에서 글로벌 최상위권 성능 입증
- 한국어 포함 201개 언어 지원으로 다국어 서비스 및 지역 특화 작업에 강점
- FP8 양자화 가중치를 기본 제공하여 대규모 인프라에서의 즉각적인 배포 지원
- Apache-2.0 라이선스 적용으로 기업의 상업적 활용 및 커스텀 수정에 용이
121
Likes
205.6k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.