microsoft/Fara-7B
이미지-텍스트 입력 기반 텍스트 생성 및 멀티모달 대화7Bmit
Microsoft에서 공개한 Qwen2.5-VL 아키텍처 기반의 7B 파라미터 멀티모달 비전 언어 모델.
학습 방식 · Qwen2.5-VL 아키텍처 기반의 멀티모달 사전학습 모델
핵심 포인트
- 이미지 기반 텍스트 생성
- 멀티모달 대화
- 시각적 정보 이해 및 분석
595
LIKES
15.4k
DOWNLOADS
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.