브라우저에서 실행되는 90개 도구의 프라이버시 중심 PDF 툴킷
WebAssembly 기반으로 브라우저에서 90개 이상의 PDF 작업을 클라이언트 사이드로 처리하는 프라이버시 중심 툴킷이다.
TL;DR
PDFCraft는 WebAssembly와 브라우저 라이브러리를 결합해 모든 PDF 편집·변환·보안 기능을 클라이언트 사이드에서 실행하는 툴킷으로, 문서를 서버로 전송하지 않아 개인정보 노출 위험을 제거한다. 90개 이상의 도구와 노드 기반 워크플로 에디터를 통해 복잡한 파이프라인을 시각적으로 구성하고 템플릿으로 저장해 배치 처리를 자동화할 수 있다. 정적 내보내기 및 Docker 배포 옵션을 제공해 서버 없는 호스팅 환경에도 적합하며 워크플로 에디터는 현재 베타 단계로 일부 기능이 불안정할 수 있다. 로컬 개발은 Node.js 18.17+ 환경에서 패키지 설치와 npm run dev로 시작하거나 사전 빌드된 Docker 이미지를 바로 실행하면 된다. 이는 민감 문서를 다루는 환경에서 네트워크 전송 리스크를 낮추면서도 풍부한 PDF 처리 기능을 브라우저로 제공하는 솔루션이다.
주요 기능
- 로컬에서 PDF 파일을 처리하여 파일 업로드 없이 병합·분할·압축·변환·편집 작업을 수행한다. 이 방식은 민감한 문서가 외부 서버로 전송되지 않게 하여 개인정보 노출 위험을 줄인다. WebAssembly와 브라우저 기반 라이브러리를 결합해 네이티브에 가까운 처리 성능을 제공한다.
- 워크플로 에디터에서 도구를 노드로 연결해 자동화 파이프라인을 구성하고 저장한 템플릿을 재사용할 수 있다. 에디터는 형식 호환성 실시간 검증과 배치 처리를 지원하여 반복 문서 작업을 효율화한다. 시각적 편집 인터페이스는 드래그 앤 드롭으로 복잡한 작업 흐름을 조합할 수 있게 한다.
- 광범위한 포맷 변환 기능을 제공하여 이미지·오피스·전자책 등 다양한 파일을 PDF로 변환하거나 PDF에서 이미지·DOCX·Excel 등으로 추출할 수 있다. OCR과 테이블 추출 같은 기능을 통해 스캔 문서의 검색 가능성 및 구조화된 데이터 추출을 지원한다. 보안 기능으로 암호화·메타데이터 제거·권한 설정 등 문서 보호 옵션을 포함한다.
어떻게 동작하는가
PDFCraft는 브라우저에서 WebAssembly로 빌드된 PDF 처리 엔진과 JavaScript 라이브러리(pdf-lib, PDF.js 등)를 로드해 모든 작업을 클라이언트에서 실행한다. 사용자가 파일을 업로드하는 대신 브라우저 메모리에서 직접 페이지 분할·압축·렌더링·텍스트 추출 등을 수행하며, 워크플로 에디터는 각 도구의 입력·출력 포맷을 연결해 파이프라인을 구성한다.
해결 문제
기존 온라인 PDF 도구는 파일을 서버로 전송해 개인정보 노출과 네트워크 지연을 초래하는 문제가 있었다. PDFCraft는 WebAssembly 기반의 클라이언트 사이드 처리를 통해 파일 전송 없이 동일한 편집·변환·보안 기능을 제공하여 개인정보 위험을 제거했다. 또한 다수의 도구와 노드 기반 워크플로를 통합해 반복적이고 배치성인 문서 작업을 자동화할 수 있게 한다.
지금 주목받는 이유
프라이버시와 보안에 대한 관심이 높아지는 가운데 클라이언트 사이드에서 완전한 PDF 처리 파이프라인을 제공하는 프로젝트라는 점이 주목을 받는다. 브라우저 기반으로 동작하며 WebAssembly를 활용해 네이티브에 가까운 성능을 내는 구조가 최근 웹 기술 트렌드와 맞물린다. 또한 워크플로 에디터의 도입으로 단순 변환 도구를 넘어 자동화 플랫폼 형태로 확장하려는 시도가 관심을 끌고 있다.
차별점
- 모든 처리 로직을 브라우저에서 실행하므로 서버 업로드가 필요 없고 민감 문서의 유출 위험을 근본적으로 낮춘다. WebAssembly로 핵심 라이브러리를 이식해 로컬 실행 성능을 확보하며, 이는 서버 기반 변환과 비교해 네트워크 지연을 제거하는 효과가 있다. 이 접근 방식은 조직 내 보안 정책이나 규제 요구가 있는 환경에서 유리하다.
- 90개가 넘는 도구를 단일 UI로 통합해 단일 페이지에서 편집·변환·보안 기능을 연속적으로 적용할 수 있다. 워크플로 에디터는 노드 연결을 통해 도구 조합을 시각적으로 구성하고 템플릿으로 저장·재사용할 수 있어 대량 문서 처리 파이프라인을 간단히 구축할 수 있다. 실시간 포맷 호환성 검증과 배치 처리 기능이 포함되어 운영 효율을 높인다.
- 정적 내보내기(output: 'export')와 다양한 배포 구성(Docker, Vercel, Netlify 등)을 제공해 서버 없는 호스팅 시나리오에 바로 적용할 수 있다. WASM MIME 타입과 이미지 최적화 같은 배포 관련 설정을 README에서 명시해 실제 배포 시 발생하는 문제를 사전에 대비하게 한다. 이로 인해 소규모 인프라로도 서비스 운영이 가능하다.
사용 사례
- 내부 규정상 문서를 외부로 전송할 수 없는 상황에서 현장 데이터(계약서·민감 서류)를 웹 브라우저로 바로 편집·암호화해 배포할 때 유용하다. 브라우저에서 모든 처리가 이루어지므로 파일이 외부 서버를 통과하지 않아 규제 준수가 쉬워진다. 배포는 정적 호스팅이나 Docker로 간단히 구성할 수 있다.
- 대량 문서의 전처리 파이프라인을 워크플로 에디터로 구성해 문서 조합·압축·워터마크·내보내기 작업을 일괄 처리할 때 효율성이 높다. 템플릿 저장과 배치 처리를 통해 반복 작업을 자동화할 수 있으며, 실시간 형식 검증으로 중간 에러를 줄인다. 회계 보고서나 청구서 등 규칙화된 문서 처리에 적합하다.
- 스캔한 종이문서를 OCR로 처리해 검색 가능 PDF로 변환하거나 표와 이미지를 추출해 구조화된 데이터로 전환하는 데이터 추출 파이프라인에서 활용할 수 있다. 브라우저 기반 OCR과 추출 도구를 결합해 클라이언트에서 즉시 결과를 확인하고 후속 처리를 진행할 수 있다. 이 과정은 개인정보가 포함된 문서에서 특히 유용하다.
시작하기
로컬에서 테스트하려면 Node.js 18.17 이상 환경에서 리포지토리를 클론한 뒤 패키지 매니저로 의존성을 설치하고 개발 서버를 실행하면 된다. Docker를 선호하면 사전 빌드된 ghcr 이미지로 컨테이너를 실행하거나 Docker Compose로 개발·프로덕션 모드를 선택해 빌드할 수 있다. 브라우저에서 http://localhost:3000(개발) 또는 http://localhost:8080(컨테이너)으로 접속해 기능을 확인하면 된다.
요구사항
- Node.js 18.17 이상과 npm·yarn·pnpm 중 하나가 필요하며 로컬 개발 시 Turbopack 기반 개발 서버가 동작한다. WebAssembly 기반 PDF 처리를 위해 브라우저가 WASM을 지원해야 정상 동작한다. Docker를 사용하는 경우 사전 빌드 이미지를 내려받아서 실행하거나 Docker Compose로 빌드·실행할 수 있다.
이미지 분석

7.5k
Stars
1.7k
Forks
+208
Trending
1
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.