120B 파라미터의 지식을 12B의 연산량으로 처리하는 Latent-MoE 아키텍처 혁신
텍스트 생성 및 대화형 AI120B (Active 12B)other
Latent-MoE와 Multi-Token Prediction 기술을 적용하여 효율성과 성능을 극대화한 NVIDIA의 차세대 대규모 언어 모델이다.
핵심 역량
- 다국어 텍스트 생성 및 번역
- 복잡한 문맥의 멀티턴 대화 수행
- 논리적 추론 및 문제 해결
- 코드 작성 및 디버깅 보조
강점
- 120B급 모델의 성능을 12B급 연산 비용으로 구현
- NVIDIA 하드웨어 가속 및 TensorRT-LLM 최적화에 특화
- MTP 적용으로 기존 MoE 모델 대비 높은 토큰 처리 효율 확보
훈련 방식
Nemotron-3 기반 Latent-MoE 아키텍처와 Multi-Token Prediction 기법 적용, NVIDIA 전용 데이터셋으로 사전 학습 및 SFT/DPO 수행
알아두면 좋은 것
- 총 120B 파라미터 중 추론 시 12B만 사용하는 Latent-MoE 구조 채택
- Multi-Token Prediction(MTP) 기술을 통한 학습 및 추론 효율성 증대
- 영어, 일본어, 중국어, 독일어, 프랑스어 등 주요 다국어 지원
- NVIDIA 전용 라이선스 적용으로 상업적 이용 시 별도 조건 확인 필요
297
Likes
125.5k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.