zai-org/GLM-OCR
Python0 / 0
GLM-V 아키텍처를 기반으로 복잡한 문서의 레이아웃을 분석하고 텍스트, 표, 수식을 정밀하게 추출하는 경량 OCR 모델이다.
핵심 포인트
- OmniDocBench V1.5에서 94.62점을 기록하며 문서 이해 성능 부문 전체 1위 달성
- 0.9B 파라미터의 경량 모델로 설계되어 vLLM, SGLang, Ollama를 통한 저지연 추론 환경 구축
- PP-DocLayout-V3 기반의 레이아웃 분석 모듈을 통합하여 복잡한 표, 코드, 인장 인식 최적화
- pip install glmocr 명령어로 설치 가능한 SDK를 통해 한 줄의 코드로 OCR 기능 호출
4.7k
STARS
387
FORKS
+461
TRENDING
0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.