jingyaogong/minimind
Python0 / 0
PyTorch를 사용하여 26M 파라미터 규모의 GPT 모델을 데이터 정제부터 강화학습까지 직접 구현하는 오픈소스 프로젝트
핵심 포인트
- 26M에서 145M 사이의 초경량 Dense 및 MoE 아키텍처 모델 제공
- PyTorch 기반의 토크나이저, 사전 학습, SFT, LoRA, RLHF 전 과정 코드 포함
- DeepSeek-R1의 추론 능력을 이식하는 모델 증류 및 GRPO 강화학습 구현
- llama.cpp, vLLM, Ollama 등 주요 추론 엔진과의 완벽한 호환성 지원
43.3k
STARS
5.2k
FORKS
+556
TRENDING
0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.