NVIDIA NVFP4로 최적화된 Gemma 4 31B: 더 가볍고 강력한 추론 성능
텍스트 생성 및 대화형 AI31Bother
Google의 Gemma 4 31B Instruction Tuned 모델을 NVIDIA의 NVFP4 기법으로 양자화하여 추론 효율을 극대화한 모델이다.
핵심 역량
- 텍스트 생성
- 대화형 질의응답
- 지시어 이행(Instruction Following)
강점
- NVFP4 양자화를 통한 메모리 사용량 절감
- NVIDIA GPU 환경에서의 추론 최적화
훈련 방식
Google Gemma 4 31B IT 기반 NVIDIA Model Optimizer를 활용한 NVFP4 양자화
알아두면 좋은 것
- Google Gemma 4 31B IT 모델 기반
- NVIDIA NVFP4 양자화 적용
- NVIDIA Model Optimizer(ModelOpt) 프레임워크 사용
- Safetensors 포맷 제공
411
Likes
1.3M
Downloads
7 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.