0.8B 파라미터로 구현한 262K 컨텍스트와 201개 언어 지원의 혁신
멀티모달 텍스트 생성 (이미지 및 텍스트 입력 기반)0.8B262K 컨텍스트apache-2.0
이미지와 텍스트를 동시에 이해하며 초경량 환경에서도 강력한 추론 성능을 제공하는 멀티모달 모델입니다.
핵심 역량
- 262K 토큰의 네이티브 컨텍스트 길이 지원
- 201개 이상의 다국어 및 방언 처리 능력
- 이미지-텍스트 통합 비전-언어 파운데이션 아키텍처
- Gated Delta Networks 기반의 고효율 추론 성능
- 강화학습(RL)을 통한 실세계 적응력 및 일반화 능력
알아두면 좋은 것
- IFEval 52.1점(Non-Thinking)으로 우수한 지시 이행 능력 증명
- 한국어를 포함한 201개 언어 지원으로 글로벌 서비스 배포 가능
- Transformers, vLLM, SGLang 등 주요 프레임워크와 즉시 호환
- 0.8B 소규모 모델임에도 비전 인코더를 포함한 통합 아키텍처 구현
461
Likes
1.9M
Downloads
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.