IQ3_XSS 양자화
대형 언어 모델의 가중치를 낮은 비트 수로 표현해 메모리 사용량을 줄이는 양자화 형식입니다. 원문에서는 16GB VRAM 환경에서 Qwen3.8 27B를 실행하기 위한 설정으로 언급됐습니다.