본문으로 건너뛰기

GLM-OCR

GLM-OCR

GLM-OCR은 이미지 크롭 영역에서 텍스트를 추출하는 텍스트 인식 블록으로, 튜토리얼에서는 검출된 계측기 영역을 Dynamic Crop으로 잘라낸 뒤 각 크롭을 독립적으로 OCR에 전달해 기호 태그(예: FT 1702)를 읽도록 구성되었다. 각 크롭의 OCR 결과는 Dimension Collapse 블록으로 합쳐지고 사용자 정의 포맷 블록이 빈 결과를 'unreadable'로 치환해 출력 순서를 보존했다. OCR 품질은 크롭 해상도와 문자 선명도에 민감하므로 크롭 패딩이나 고해상도 타일 학습으로 개선 가능하다.