NVIDIA FP4 기술로 최적화된 Qwen3.6-35B MoE 모델
텍스트 생성 및 추론35B
Qwen3.6-35B-A3B 모델을 NVIDIA FP4 형식으로 양자화하여 추론 효율성을 극대화한 경량화 모델.
핵심 역량
- 텍스트 생성
- 복잡한 추론
- 대화형 인터페이스
강점
- FP4 양자화를 통한 메모리 효율성 극대화
- vLLM 기반의 고성능 추론 지원
훈련 방식
Qwen3.6-35B-A3B 기반 NVIDIA FP4 양자화 적용
알아두면 좋은 것
- NVIDIA FP4 양자화 적용
- vLLM 추론 엔진 지원
- Qwen3.6-35B-A3B 기반 MoE 구조
106
Likes
524.3k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.