google-ai-edge/LiteRT-LM
C++0 / 0
모바일, 데스크톱, 임베디드 기기에서 LLM을 CPU/GPU/NPU 가속을 통해 고성능으로 실행하는 구글의 공식 추론 프레임워크입니다.
핵심 포인트
- CPU, GPU 및 NPU(Qualcomm/MediaTek) 하드웨어 가속 지원
- Gemma 3, Phi-4, Qwen 2.5 등 주요 오픈 모델 최적화 배포
- 멀티모달(시각, 음성) 입력 및 함수 호출(Function Calling) 기능 제공
- Kotlin, C++, Swift 등 다양한 언어 바인딩 및 SDK 지원
2k
STARS
209
FORKS
+642
TRENDING
0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.