Qwen 3.6 27B의 강력한 성능을 로컬에서 더 빠르게, MTP 지원 GGUF 공개
멀티모달 이미지 및 텍스트 생성27Bapache-2.0
Qwen 3.6 27B 모델을 llama.cpp에서 실행 가능하도록 GGUF 포맷으로 양자화하고 멀티 토큰 예측(MTP)을 통해 추론 속도를 최적화한 모델입니다.
핵심 역량
- 이미지 및 텍스트 입력을 통한 멀티모달 대화
- 멀티 토큰 예측 기반의 고속 텍스트 생성
- llama.cpp 프레임워크를 통한 로컬 추론
- 다국어 텍스트 이해 및 생성
강점
- MTP 지원으로 일반 양자화 모델 대비 빠른 추론 속도 구현
- 27B 파라미터 모델을 GGUF 포맷으로 변환하여 소비자용 GPU에서 실행 가능
- Apache 2.0 라이선스 기반의 자유로운 활용성
훈련 방식
Qwen 3.6 27B 기반의 MTP(Multi-Token Prediction) 아키텍처 적용 및 GGUF 양자화
알아두면 좋은 것
- Qwen 3.6 27B 및 Qwen 3.5 계열과의 호환성 유지
- MTP(Multi-Token Prediction) 기술을 통한 추론 가속화 지원
- Apache 2.0 라이선스로 상업적 이용 가능
- 영어 및 중국어를 포함한 다국어 데이터셋으로 학습
58
Likes
52.4k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.