NVIDIA의 NVFP4 양자화로 최적화된 DiffusionGemma-26B-A4B-IT 모델
텍스트 생성 및 대화형 응답26Bapache-2.0
NVIDIA의 ModelOpt를 사용하여 DiffusionGemma-26B-A4B-IT 모델을 NVFP4 형식으로 양자화하여 추론 성능과 메모리 효율을 최적화한 모델.
핵심 역량
- 대화형 텍스트 생성
- 지시 사항 이행
- 문맥 기반 추론
강점
- NVFP4 양자화를 통한 추론 메모리 최적화
- NVIDIA GPU 환경에서 최적화된 실행 성능
훈련 방식
Google의 DiffusionGemma-26B-A4B-IT 모델을 NVIDIA ModelOpt를 사용하여 NVFP4 형식으로 양자화
알아두면 좋은 것
- NVIDIA ModelOpt를 통한 NVFP4 양자화 적용
- Apache 2.0 라이선스 기반 상업적 이용 가능
- 기반 모델: google/diffusiongemma-26B-A4B-it
73
Likes
242.3k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.