70개 이상의 언어를 정복한 3.3B 규모의 초경량 다국어 특화 베이스 모델
다국어 텍스트 생성 및 언어 모델링3.35B8K 컨텍스트cc-by-nc-4.0
한국어를 포함한 70개 이상의 다국어 환경에 최적화된 3.35B 규모의 고성능 경량 베이스 모델입니다.
핵심 역량
- 70개 이상의 다국어 지원 (한국어 포함)
- 3.35B 파라미터의 경량 설계로 로컬 배포 용이
- 8K 토큰 컨텍스트 길이 지원
- 슬라이딩 윈도우 어텐션 기반의 효율적인 추론
- 저리소스 언어(Low-resource)에 대한 강력한 표현력
알아두면 좋은 것
- 한국어를 포함하여 전 세계 70개 이상의 언어 데이터로 사전 학습됨
- 8K 입력 및 8K 출력 컨텍스트를 지원하여 긴 문맥 처리 가능
- 일반적인 텍스트 생성에는 강하나 복잡한 수학적 추론(MGSM 등)에는 제한적임
- 비영리 연구 목적의 CC-BY-NC-4.0 라이선스 적용
39
Likes
2k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.