nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4
텍스트 생성 및 다국어 대화120Bother
120B 파라미터의 성능을 12B의 연산량과 NVFP4 양자화로 구현하여 효율성을 극대화한 NVIDIA의 차세대 언어 모델이다.
학습 방식 · Nemotron-3 120B 기반 Latent MoE 아키텍처에 NVFP4 양자화 및 Multi-Token Prediction 적용
핵심 포인트
- 120B 파라미터의 지식을 12B 수준의 연산 비용으로 실현
- NVFP4 양자화로 메모리 사용량을 획기적으로 절감
- MTP 기술을 통한 추론 처리량(Throughput) 개선
- 다국어 텍스트 생성 및 번역
208
LIKES
948.4k
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.