본문으로 건너뛰기
multimodal-llm
멀티모달 대형언어모델
이미지와 텍스트를 동시에 입력으로 받아 시맨틱 캡션을 생성할 수 있는 모델 계열로, 이미지 이해→텍스트 생성 흐름을 한 번의 추론으로 처리한다.
비슷한 개념
multimodal-large-language-model
unified-multimodal-model
unified-mllm
vision-llm
omni-modal-llm
dense-image-captioning
omnimodal-llm
video-mllm
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필