IBM Granite 311M: ModernBERT 기반의 고성능 다국어 임베딩
문장 및 문서 임베딩 추출311Mapache-2.0
ModernBERT 아키텍처를 기반으로 한국어를 포함한 다국어 텍스트를 고효율 벡터로 변환하는 311M 파라미터 규모의 임베딩 모델이다.
핵심 역량
- 다국어 문장 유사도 측정
- 시맨틱 검색 및 정보 검색
- 가변 차원 임베딩 생성
- 텍스트 특징 추출
강점
- 311M의 경량 파라미터로 높은 추론 효율성 확보
- ONNX 및 OpenVINO 지원으로 다양한 하드웨어 가속 가능
- MTEB 벤치마크 기반의 검증된 다국어 검색 성능
훈련 방식
ModernBERT 기반 아키텍처에 Matryoshka Embedding 기법을 적용한 다국어 코퍼스 학습
알아두면 좋은 것
- 한국어를 포함한 다국어 데이터셋으로 학습됨
- ModernBERT 기반의 효율적인 인코더 구조 채택
- Matryoshka 학습 방식을 통한 벡터 차원 최적화 지원
- Apache-2.0 라이선스로 상업적 이용 가능
70
Likes
7.9k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.