GGUF Q4_0 양자화로 로컬 인퍼런스에 최적화된 Gemma-4-12B-it
다양한 입력에서 텍스트 응답 생성 및 대화형 ML 태스크 수행(자연어 대화, 요약, 질문응답 등).12Bapache-2.0
Google Gemma 4-12B 기반의 GGUF Q4_0 양자화 버전으로, any-to-any 대화에 적합한 12B 규모의 LLM이다.
핵심 역량
- 다중턴 대화
- 텍스트 생성 및 응답
- 다양한 입력 형식 처리
- 한국어/다국어 텍스트 처리
- 로컬 인퍼런스 가능(GGUF 양자화)
강점
- Apache-2.0 라이선스
- GGUF 양자화로 로컬 인퍼런스 지원 가능
- 12B 규모의 실용적 활용성
훈련 방식
Gemma-4-12B-it 기반 GGUF Q4_0 양자화 버전으로 구성된 베이스 모델(양자화 포맷 적용)
알아두면 좋은 것
- 라이선스 Apache-2.0으로 상업적 사용 가능
- GGUF 양자화(Q4_0)로 12B 모델의 메모리 소모 및 로딩 속도 개선 가능성
- base 모델은 google/gemma-4-12B-it-qat-q4_0-unquantized 계열로 명시
- 엔드포인트 호환성 및 us 지역 배포를 위한 구성 요소 명시
262
Likes
370.4k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.