NVIDIA Nemotron-Cascade-2: 30B 규모 중 3B만 활성화하여 효율과 추론 성능 극대화
텍스트 생성 및 복합 논리 추론30Bother
NVIDIA가 개발한 30B 파라미터 규모의 모델로, SFT와 RL을 통해 복합 추론 능력을 강화하고 연산 효율을 높인 텍스트 생성 모델이다.
핵심 역량
- 복합 논리 추론 및 문제 해결
- 멀티턴 대화 수행
- 지시어 이행(Instruction Following)
- 텍스트 요약 및 생성
강점
- 30B 규모 대비 낮은 활성 파라미터(3B)로 높은 추론 효율 달성
- NVIDIA 생태계(Azure, NIM)와의 뛰어난 배포 호환성
- SFT/RL을 통한 강화된 논리 추론 및 정렬 성능
훈련 방식
Nemotron-Cascade-2 기반 SFT 및 RL 정렬 학습, 30B 전체 파라미터 중 3B 활성화 구조 채택
알아두면 좋은 것
- SFT 및 RL 기반의 정렬 학습을 통한 추론 성능 강화
- NVIDIA의 독자적인 Nemotron-Cascade-2 아키텍처 적용
- Azure 배포 및 엔드포인트 호환성 지원
- 영어 중심의 범용 및 논리 추론 태스크 최적화
457
Likes
141.8k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.