본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

이미지·비디오+텍스트 입력 기반 대화형 텍스트 생성 (검열 완화 GGUF 로컬 배포)35B (MoE, 활성 약 3B)256K 컨텍스트apache-2.0

Qwen3.6-35B-A3B MoE의 거부 응답만 없앤 GGUF 양자화 배포, 465개 프롬프트에서 거부 0건.

TL;DR

이 저장소는 Qwen3.6-35B-A3B MoE(256 전문가, 토큰당 8개 라우팅, 활성 파라미터 약 3B)를 데이터·기능은 그대로 두고 거부 응답만 제거한 HauhauCS의 'Aggressive' 무검열 변형으로, 465개 테스트 프롬프트에서 거부 0건을 기록했다고 밝힌다. K_P('Perfect') 양자화라는 자체 imatrix 기반 방식으로 파일 크기를 5~15%만 늘려 같은 비트대 일반 GGUF보다 품질을 1~2단계 끌어올렸다고 주장하며, Q8부터 IQ2까지 다양한 정밀도와 비전용 mmproj 파일을 함께 제공한다. 262K 네이티브 컨텍스트와 선형:완전 소프트맥스 3:1 비율의 하이브리드 어텐션을 갖춰 llama.cpp·LM Studio 등 GGUF 호환 런타임에서 바로 구동되며, thinking 능력을 유지하려면 최소 128K 컨텍스트를 권장한다. 검열 없는 응답이 필요하면서도 원본 Qwen3.6의 능력은 그대로 쓰고 싶은 로컬 배포 사용자에게 맞춰져 있다.

핵심 포인트

  • 데이터·기능 변경 없이 거부 응답만 제거해, 465개 테스트 프롬프트에서 거부 0건을 기록했다고 밝혔다.
  • K_P 자체 imatrix 양자화로 파일 크기를 5~15%만 늘려 같은 비트대 일반 GGUF보다 품질을 1~2단계 끌어올렸다고 주장한다.
  • Q8부터 IQ2까지 폭넓은 정밀도와 비전용 mmproj를 함께 제공해 llama.cpp·LM Studio에서 이미지까지 다룬다.
  • 262K 네이티브 컨텍스트를 지원하지만 thinking 능력을 온전히 쓰려면 최소 128K 컨텍스트를 유지하도록 권장한다.

제한사항

  • Aggressive 변형은 완전히 검열이 풀려 있어 짧은 고지문구가 붙을 수는 있지만 거부 없이 콘텐츠를 그대로 생성하므로, 안전장치가 필요한 배포에는 부적합하고 안전장치를 일부 유지하는 Balanced 변형이 별도로 예정돼 있다.
  • K_P 퀀트는 LM Studio의 양자화 정보 열에서 '?'로 표시될 수 있는데 이는 표시 오류일 뿐 실제 로딩·구동에는 문제가 없다고 저자가 밝혔다.

3.5k

LIKES

2.5M

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.