nvidia/Gemma-4-26B-A4B-NVFP4
텍스트 생성 및 대화형 언어 모델링26Bother
Google의 Gemma 4 26B 모델을 NVIDIA Model Optimizer를 통해 NVFP4 형식으로 양자화하여 Blackwell GPU 추론 성능을 극대화한 모델이다.
학습 방식 · Google Gemma 4 26B-A4B-it 기반, NVIDIA Model Optimizer를 사용한 NVFP4 양자화 적용
핵심 포인트
- NVFP4 적용으로 Blackwell GPU에서 추론 처리량 극대화 가능
- 26B 모델의 메모리 점유율을 4비트 수준으로 대폭 절감
- NVIDIA 하드웨어 생태계와의 높은 호환성
- 멀티턴 대화 수행
34
LIKES
192.5k
DOWNLOADS
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.