Qwen 2.5 아키텍처 기반의 고성능 PDF-to-Markdown OCR 모델
이미지 및 PDF 텍스트 추출 및 마크다운 변환 (OCR)openrail
PDF와 이미지를 레이아웃이 보존된 마크다운 형식으로 변환하는 OCR 특화 멀티모달 모델이다.
핵심 역량
- 이미지 내 텍스트 추출
- PDF 문서의 마크다운 변환
- 문서 레이아웃 및 구조 분석
- 멀티턴 문서 기반 대화
강점
- 문서 레이아웃 보존 및 마크다운 출력 특화
- Qwen 2.5 기반의 우수한 다국어 처리 성능
훈련 방식
Qwen 2.5 기반 이미지-텍스트 정렬 및 OCR 데이터셋 파인튜닝
알아두면 좋은 것
- Qwen 2.5 기반의 강력한 언어 이해 능력 결합
- 표(Table) 및 복잡한 레이아웃 보존 지원
- OpenRAIL 라이선스 적용
- 다국어 OCR 지원
302
Likes
243.2k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.