본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

nvidia/gpt-oss-puzzle-88B

텍스트 생성 및 복합 추론88Bother

Mixture-of-Experts(MoE) 아키텍처와 MXFP4 양자화를 적용하여 추론 성능과 효율성을 극대화한 88B 파라미터 규모의 언어 모델이다.

학습 방식 · Mixture-of-Experts(MoE) 아키텍처 기반의 사전 학습 및 추론 최적화 기법 적용

핵심 포인트

  • 88B 규모임에도 MoE 구조로 연산 효율성 확보
  • MXFP4 지원으로 추론 시 메모리 점유율 감소
  • vLLM 호환을 통한 높은 처리량(Throughput) 제공
  • 복합 논리 추론

89

LIKES

14.6k

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.