본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

nvidia/NVIDIA-Nemotron-3-Nano-4B-GGUF

텍스트 생성 및 대화형 추론4Bother

NVIDIA의 4B 규모 Nemotron-3-Nano 모델을 GGUF 포맷으로 양자화하여 로컬 환경에서의 에이전트 및 추론 성능을 극대화한 모델이다.

학습 방식 · NVIDIA-Nemotron-3-Nano-4B-FP8 기반, Nemotron-CC-v2 및 에이전트/수학 특화 데이터셋을 활용한 포스트 트레이닝 및 GGUF 양자화

핵심 포인트

  • 4B 규모 모델 중 최상위권의 에이전트 및 수학 추론 성능
  • GGUF 양자화를 통한 메모리 점유율 최소화 및 추론 속도 향상
  • NVIDIA의 검증된 데이터셋 기반의 정교한 지시 이행 능력
  • 멀티턴 대화 및 복잡한 지시 이행

106

LIKES

16.6k

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.