30B급 최강의 추론 성능, MoE 아키텍처로 효율과 파워를 동시에 잡다
텍스트 생성 및 복합 추론30B (MoE)128K 컨텍스트mit
30B 규모의 MoE 구조를 통해 수학, 코딩, 복합 추론에서 동급 모델 대비 압도적인 성능을 제공하는 경량 고성능 모델입니다.
핵심 역량
- 30B 규모 MoE 아키텍처 (A3B 활성 파라미터)
- 최대 128K 토큰 컨텍스트 길이 지원
- AIME 25 벤치마크 91.6점의 강력한 수학 추론
- SWE-bench Verified 59.2점의 고수준 코딩 능력
- Preserved Thinking 모드를 통한 에이전트 작업 최적화
- vLLM 및 SGLang 프레임워크 공식 지원
알아두면 좋은 것
- AIME 25(91.6), GPQA(75.2) 등 주요 벤치마크에서 30B급 모델 중 최상위 성능 기록
- 영어(en) 및 중국어(zh) 데이터셋에 최적화된 다국어 성능 제공
- MIT 라이선스 적용으로 상업적 활용 및 수정에 대한 높은 자유도 보장
- vLLM 및 SGLang의 최신 브랜치를 통한 효율적인 로컬 서빙 가이드 포함
1.6k
Likes
1.7M
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.