문서 이미지에서 데이터를 즉시 추출하는 NuExtract 3: Qwen 3.5 기반의 고성능 VLM
문서 이미지 이해, 구조화된 데이터 추출, OCR, 문서-마크다운 변환4Bapache-2.0
Qwen 3.5 4B를 기반으로 문서 이미지 내 텍스트와 구조를 정확하게 파악하여 JSON 등 구조화된 데이터로 변환하는 Vision Language Model이다.
핵심 역량
- 문서 이미지 텍스트 추출
- 구조화된 데이터 포맷 변환 (JSON 등)
- 문서-마크다운 변환
- 시각적 문서 이해 및 추론
강점
- 동급 4B 파라미터 모델 대비 문서 이해 정확도가 높다
- Apache 2.0 라이선스로 상업적 활용이 가능하다
훈련 방식
Qwen 3.5 4B 기반으로 문서 이해 및 구조화 추출 태스크에 맞춰 파인튜닝 수행
알아두면 좋은 것
- Qwen 3.5 4B 기반
- Apache 2.0 라이선스
- 다국어 지원
- 문서 이해 및 구조화 추출 특화
222
Likes
65.9k
Downloads
0 / 0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.