311만 회 이상의 다운로드가 증명하는 한국어 지원 GLM 기반 고성능 OCR 모델
이미지 텍스트 추출 (OCR)mit
GLM 아키텍처를 활용하여 한국어와 다국어 이미지 속 텍스트를 정밀하게 추출하는 오픈소스 OCR 모델이다.
핵심 역량
- 한국어 및 다국어 텍스트 인식
- 이미지 내 복잡한 레이아웃 분석
- 필기체 및 인쇄체 텍스트 추출
- 문서 이미지의 구조적 텍스트 변환
강점
- 한국어 포함 8개국 이상의 다국어 텍스트 인식 지원
- MIT 라이선스 적용으로 제약 없는 상업적 활용 가능
- 311만 건 이상의 다운로드로 검증된 실무 적용성
훈련 방식
GLM 기반 아키텍처에 다국어 이미지-텍스트 쌍 데이터를 활용한 지도 학습 기반 파인튜닝 기법 적용
알아두면 좋은 것
- 한국어, 영어, 중국어, 일본어 등 다국어 지원
- MIT 라이선스로 상업적 이용 및 수정 가능
- GLM 아키텍처 기반의 높은 추론 효율성
- 311만 건 이상의 다운로드 수로 검증된 안정성
1.6k
Likes
5.3M
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.