huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated
기본 Gemma‑4 12B 코더 모델을 기반으로 'abliteration' 기법으로 거부 응답을 제거한 실험적(uncensored) 변형으로, 안전 필터링이 약화된 상태에서 텍스트·코드 생성 기능을 제공한다.
학습 방식 · 기반 모델은 yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1이며 README는 해당 기반에서 'abliteration'으로 거부 응답을 제거한 변형임을 명시하나 추가 훈련 기법·데이터 관련 상세 정보는 제공하지 않음.
TL;DR
이 모델은 yuxinlu1의 Gemma‑4 12B 코더 모델을 기반으로 'abliteration' 기법을 적용해 거부(refusal) 응답을 제거한, 검열이 약화된 변형이다. README는 해당 변형이 TransformerLens를 사용하지 않은 증명적(proof-of-concept) 구현임을 명시하며, 원본 모델 링크와 관련 도구 링크를 제공한다. 거부 응답 제거 과정은 모델의 안전 필터링을 크게 약화시키는 결과를 낳으며, README는 민감·논쟁적·부적절한 출력 생성 위험을 반복해서 경고한다. 이 때문에 실사용 환경보다는 연구·테스트 목적과 실시간 모니터링 하의 검증용으로 배포된 점이 핵심 차별화 요소다. 결과적으로 이 변형은 검열·거부 응답을 제거해 더 넓은 출력을 생성할 수 있으나, 안전성 검증이 이루어지지 않아 법적·윤리적 책임이 사용자에게 있음이 명확히 표기되어 있다. 성능 수치·세부 훈련 절차는 README에 제공되지 않는다.
핵심 포인트
- 거부 응답 제거(abliterated) 상태로 제공되어 기본 Gemma-4 기반 공개 모델과 달리 응답 거부가 제거된 점
- TransformerLens 없이 'remove-refusals-with-transformers' 계열 접근으로 거부 제거를 시도한 증명적 구현이라는 점
- 명시적 안전 약화 경고와 연구/실험용으로 제한한 사용 권고(일반 공개용 안전 최적화 미적용)
- Apache-2.0 라이선스(메타데이터에 명시)
139
LIKES
7.2k
DOWNLOADS
3 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.