LiquidAI/LFM2.5-VL-450M
이미지 및 텍스트 입력을 통한 텍스트 생성 (VQA, 이미지 캡셔닝 등)450Mother
LiquidAI의 LFM2.5-350M 언어 모델을 기반으로 이미지 이해 능력을 결합한 4억 5천만 파라미터 규모의 초경량 멀티모달 모델이다.
학습 방식 · LiquidAI/LFM2.5-350M 기반의 멀티모달 파인튜닝 및 이미지-텍스트 정렬 학습
핵심 포인트
- 450M의 극소형 파라미터로 엣지 환경 최적화
- 한국어를 포함한 광범위한 다국어 멀티모달 성능 제공
- 이미지 내용 분석 및 설명
- 시각적 질의응답 (VQA)
152
LIKES
18.3k
DOWNLOADS
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.