일본어 LLM의 새로운 기준: 추론(Reasoning) 능력으로 Qwen3-8B를 압도하는 9B 하이브리드 모델
일본어 텍스트 생성, 추론(Reasoning), 도구 호출(Tool-calling), 대화형 AI9B128K 컨텍스트nvidia-nemotron-open-model-license
NVIDIA가 개발한 9B 규모의 일본어 특화 하이브리드 모델로, 단계별 추론(Reasoning Trace)을 통해 답변 품질을 극대화합니다.
핵심 역량
- 128K 토큰의 대규모 컨텍스트 윈도우 지원
- Mamba-2 기반 하이브리드 아키텍처로 추론 효율성 극대화
- Thinking 기능을 통한 단계별 추론(Reasoning Trace) 생성
- 일본어 특화 Tool-calling 및 에이전트 기능 최적화
- 실행 시 추론 토큰 수(Reasoning Budget) 실시간 제어 가능
알아두면 좋은 것
- Nejumi Leaderboard 4에서 평균 0.711점으로 Qwen3-8B(0.690) 대비 우수한 성능 입증
- 일본어 특화 데이터셋(Nemotron-Personas-Japan 등)을 활용한 정교한 현지화 수행
- vLLM 0.11.2 이상 및 TensorRT-LLM 지원으로 최적화된 배포 환경 제공
- 시스템 프롬프트를 통해 추론 과정 노출 여부 및 토큰 예산 설정 가능
120
Likes
12.6k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.