24B의 성능을 2B의 속도로, 온디바이스 AI를 혁신하는 하이브리드 MoE 모델
텍스트 생성, 도구 사용(Function Calling), 다국어 대화, 문서 요약24B32K 컨텍스트lfm-1.0
컨볼루션과 어텐션을 결합한 하이브리드 구조로 24B 규모의 지능과 초고속 추론 성능을 동시에 제공합니다.
핵심 역량
- 토큰당 2.3B 활성 파라미터의 고효율 MoE 구조
- 32K 토큰 컨텍스트 및 한국어 포함 9개 국어 지원
- 네이티브 함수 호출(Function Calling) 및 JSON 구조화 출력
- AMD CPU에서 112 tok/s, H100에서 293 tok/s의 빠른 추론 속도
- 32GB RAM 환경의 소비자용 기기에서 로컬 실행 가능
알아두면 좋은 것
- 17조(17T) 토큰의 대규모 데이터로 학습되어 350M부터 24B까지 선형적인 성능 향상 증명
- llama.cpp, vLLM, SGLang, MLX 등 주요 추론 프레임워크 출시 즉시 지원
- 한국어, 영어, 일본어, 중국어 등 주요 9개 언어에 대한 공식 최적화
- LFM Open License v1.0 적용으로 상업적 활용 및 연구 목적 사용 가능
279
Likes
17.4k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.