본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Qwen3.6-35B-A3B-abliterated-v4 공개와 MoE 특화 norm-preserving abliteration 적용 사례
OBLITERATUS: 대형 언어 모델의 거부 행동 분석 및 제거를 위한 오픈소스 툴킷
Qwen 3.5 2B 모델의 거부 메커니즘을 제거하는 새로운 'Abliteration' 기법 및 모델 공개
Qwen 3.5 Abliterated 버전의 검열 제거 실패 및 대안 추천
← 피드로 돌아가기
Abliteration
Safety (AI 안전성)
약 4개 아티클
관련 태그:
Qwen3.5
Hugging Face
Mechanistic Interpretability
OBLITERATUS
Qwen3.6-35B-A3B-abliterated-v4
norm-preserving biprojection
Llama 3.1