본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

spiritbuun/Qwen3.6-27B-DFlash-GGUF

대화형 텍스트 생성 및 추론 속도 최적화27Bmit

Qwen3.6 27B 모델을 기반으로 DFlash 기법과 Speculative Decoding을 적용하여 로컬 환경에서 추론 속도를 최적화한 GGUF 양자화 모델이다.

학습 방식 · Qwen3.6 27B 기반 DFlash 기법 적용 및 GGUF 양자화

핵심 포인트

  • DFlash 및 Drafter를 활용한 Speculative Decoding으로 추론 속도 향상
  • GGUF 양자화를 통한 메모리 점유율 감소 및 CPU/GPU 혼합 추론 가능
  • 27B 파라미터급 성능을 유지하면서도 최적화된 연산 효율 제공
  • 멀티턴 대화 수행

48

LIKES

11.2k

DOWNLOADS

1 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.