unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
텍스트 생성 및 추론30Bother
NVIDIA의 Nemotron-3-Nano-Omni-30B-A3B-Reasoning 모델을 Unsloth가 GGUF 형식으로 양자화하여 로컬 추론 효율성을 극대화한 모델이다.
학습 방식 · NVIDIA Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16 기반 GGUF 양자화 및 imatrix 최적화
핵심 포인트
- A3B 아키텍처를 통한 30B 규모 대비 빠른 추론 속도
- GGUF 포맷 지원으로 llama.cpp 등 다양한 런타임 호환성 확보
- NVIDIA의 최신 사후 학습 데이터셋(v3) 반영으로 추론 품질 강화
- 복잡한 논리 추론
102
LIKES
48.4k
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.