VLM-based OCR
VLM 기반 OCR
문서 이미지를 읽는 VLM을 활용해 스캔 문서, 표, 차트, 손글씨와 같은 시각 정보를 텍스트와 구조화된 데이터로 변환하는 방식입니다. 일반 텍스트 추출보다 비용이 높지만 표 셀, 위치, 문맥을 더 정확하게 보존합니다.
VLM 기반 OCR
문서 이미지를 읽는 VLM을 활용해 스캔 문서, 표, 차트, 손글씨와 같은 시각 정보를 텍스트와 구조화된 데이터로 변환하는 방식입니다. 일반 텍스트 추출보다 비용이 높지만 표 셀, 위치, 문맥을 더 정확하게 보존합니다.