AesSedai/Qwen3.5-35B-A3B-GGUF
텍스트 생성 및 대화형 AI35B
Qwen3.5-35B-A3B의 MoE 아키텍처를 분석하여 FFN 텐서를 효율적으로 압축한 고성능 GGUF 양자화 모델입니다.
핵심 포인트
- MoE 아키텍처 특화 혼합 양자화 적용
- imatrix 기반의 정밀한 가중치 압축
- Q4_K_M 기준 약 20.61 GiB의 효율적인 용량
- 낮은 Perplexity(PPL) 손실 유지
56
LIKES
22.2k
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.