nvidia/NVIDIA-Nemotron-3-Nano-4B-GGUF
텍스트 생성 및 대화형 추론4Bother
NVIDIA의 4B 규모 Nemotron-3-Nano 모델을 GGUF 포맷으로 양자화하여 로컬 환경에서의 에이전트 및 추론 성능을 극대화한 모델이다.
학습 방식 · NVIDIA-Nemotron-3-Nano-4B-FP8 기반, Nemotron-CC-v2 및 에이전트/수학 특화 데이터셋을 활용한 포스트 트레이닝 및 GGUF 양자화
핵심 포인트
- 4B 규모 모델 중 최상위권의 에이전트 및 수학 추론 성능
- GGUF 양자화를 통한 메모리 점유율 최소화 및 추론 속도 향상
- NVIDIA의 검증된 데이터셋 기반의 정교한 지시 이행 능력
- 멀티턴 대화 및 복잡한 지시 이행
106
LIKES
16.6k
DOWNLOADS
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.