Qwen 3.5 27B에 Claude급 추론 능력을 이식한 270억 파라미터 지식 증류 모델
텍스트 생성 및 논리적 추론 (Chain-of-Thought)27Bapache-2.0
Qwen 3.5 27B 모델에 고도화된 추론 데이터셋을 학습시켜 논리적 사고와 단계별 추론 능력을 극대화한 지식 증류 모델이다.
핵심 역량
- 복잡한 논리 문제 해결
- 단계별 사고 과정(CoT) 생성
- 고난도 텍스트 생성 및 요약
- 영어 및 중국어 다국어 대화
강점
- 27B 파라미터급 모델 중 최상위권의 논리 추론 성능
- Unsloth 최적화로 인한 낮은 VRAM 요구량 및 빠른 추론 속도
훈련 방식
Qwen 3.5 27B 기반, Unsloth 프레임워크를 사용한 Claude 스타일 추론 데이터셋(Opus-4.6-Reasoning) 지식 증류 학습
알아두면 좋은 것
- Claude 4.6 Opus 스타일의 필터링된 3,000개 이상의 추론 데이터셋 활용
- Qwen 3.5 27B 베이스 모델의 언어 능력을 유지하며 추론 성능 강화
- Apache 2.0 라이선스로 상업적 이용 및 수정 가능
- Unsloth 최적화를 통한 효율적인 추론 및 학습 지원
2.8k
Likes
469.6k
Downloads
32 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.