4B 파라미터 규모로 코드 분석과 도구 호출 성능을 최적화한 증류 모델
텍스트 생성 및 코드 분석4Bmit
Qwen3-4B-Instruct를 기반으로 코드 분석과 에이전트 기능을 강화한 지식 증류 모델이다.
핵심 역량
- 4B 파라미터 규모의 경량 아키텍처
- Qwen3-4B-Instruct-2507 기반 지식 증류
- MS-Swift 프레임워크 기반 학습 최적화
알아두면 좋은 것
- Qwen3-4B-Instruct-2507을 베이스 모델로 채택
- 4B 파라미터 규모의 효율적 추론 지원
- MIT 라이선스 기반의 오픈소스 배포
176
Likes
1.6k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.