RedHatAI/Qwen3.6-35B-A3B-NVFP4
텍스트 생성 및 추론35B
Qwen3.6-35B-A3B 모델을 NVIDIA FP4 형식으로 양자화하여 추론 효율성을 극대화한 경량화 모델.
학습 방식 · Qwen3.6-35B-A3B 기반 NVIDIA FP4 양자화 적용
핵심 포인트
- FP4 양자화를 통한 메모리 효율성 극대화
- vLLM 기반의 고성능 추론 지원
- 텍스트 생성
- 복잡한 추론
106
LIKES
524.3k
DOWNLOADS
1 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.