본문으로 건너뛰기
VLM
시각 언어 모델
이미지와 텍스트를 동시에 이해하고 처리할 수 있는 AI 모델이다. 문서의 시각적 구조를 직접 분석하여 텍스트와 레이아웃 정보를 한 번에 파악하는 데 활용된다.
비슷한 개념
LVM
multimodal-language-model
Vision-Language Models
Vision LLM
Vision Model
Vision-Language Pretraining
Multimodal Large Language Model
vision-analysis
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필