nvidia/Qwen3.5-397B-A17B-NVFP4
텍스트 생성 (멀티모달 입력 지원)397B (17B Active)262K 컨텍스트apache-2.0
NVIDIA ModelOpt를 통해 Qwen3.5 MoE 모델을 FP4 정밀도로 양자화하여 Blackwell 환경에서 초고속 추론을 구현한 모델입니다.
핵심 포인트
- 397B 총 파라미터 및 17B 활성화 MoE 아키텍처
- 최대 262K 토큰의 초장거리 컨텍스트 지원
- NVFP4(FP4) 양자화를 통한 추론 속도 및 메모리 효율 극대화
- 텍스트, 이미지, 비디오를 포함한 멀티모달 입력 처리
56
LIKES
68.2k
DOWNLOADS
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.