본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

AesSedai/Qwen3.5-35B-A3B-GGUF

텍스트 생성 및 대화형 AI35B

Qwen3.5-35B-A3B의 MoE 아키텍처를 분석하여 FFN 텐서를 효율적으로 압축한 고성능 GGUF 양자화 모델입니다.

핵심 포인트

  • MoE 아키텍처 특화 혼합 양자화 적용
  • imatrix 기반의 정밀한 가중치 압축
  • Q4_K_M 기준 약 20.61 GiB의 효율적인 용량
  • 낮은 Perplexity(PPL) 손실 유지

56

LIKES

22.2k

DOWNLOADS

1 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.