spiritbuun/Qwen3.6-27B-DFlash-GGUF
대화형 텍스트 생성 및 추론 속도 최적화27Bmit
Qwen3.6 27B 모델을 기반으로 DFlash 기법과 Speculative Decoding을 적용하여 로컬 환경에서 추론 속도를 최적화한 GGUF 양자화 모델이다.
학습 방식 · Qwen3.6 27B 기반 DFlash 기법 적용 및 GGUF 양자화
핵심 포인트
- DFlash 및 Drafter를 활용한 Speculative Decoding으로 추론 속도 향상
- GGUF 양자화를 통한 메모리 점유율 감소 및 CPU/GPU 혼합 추론 가능
- 27B 파라미터급 성능을 유지하면서도 최적화된 연산 효율 제공
- 멀티턴 대화 수행
48
LIKES
11.2k
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.