본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

LiquidAI/LFM2.5-VL-450M

이미지 및 텍스트 입력을 통한 텍스트 생성 (VQA, 이미지 캡셔닝 등)450Mother

LiquidAI의 LFM2.5-350M 언어 모델을 기반으로 이미지 이해 능력을 결합한 4억 5천만 파라미터 규모의 초경량 멀티모달 모델이다.

학습 방식 · LiquidAI/LFM2.5-350M 기반의 멀티모달 파인튜닝 및 이미지-텍스트 정렬 학습

핵심 포인트

  • 450M의 극소형 파라미터로 엣지 환경 최적화
  • 한국어를 포함한 광범위한 다국어 멀티모달 성능 제공
  • 이미지 내용 분석 및 설명
  • 시각적 질의응답 (VQA)

152

LIKES

18.3k

DOWNLOADS

0 / 0

조회수

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.