AI Briefing

브라우저에서 PDF 추출

Extract PDF text in your browser with LiteParse for the web

·2026.04.24 06:54

LiteParse를 브라우저에서 돌려 OCR까지 지원하는 PDF 텍스트 추출 웹앱을 만들었다.

LlamaIndex의 오픈소스 LiteParse는 원래 Node.js CLI로 PDF 텍스트를 추출하는 도구였지만, 같은 기반인 PDF.jsTesseract.js를 활용해 브라우저 전용 버전으로 옮겨졌다. 핵심은 AI 모델이 아니라 PDF 레이아웃을 읽는 spatial text parsing이며, 이미지 기반 PDF에는 OCR을 선택적으로 붙인다.

문서의 신뢰도를 높이기 위해 visual citations with bounding boxes 방식도 함께 다룬다. 답변에 근거가 된 영역을 잘라 하이라이트한 이미지를 붙이면, RAG 스타일 Q&A에서 출처 확인이 훨씬 쉬워진다.

웹 데모에서는 다음을 할 수 있다:

  • PDF를 드롭하거나 선택해 바로 추출
  • OCR 사용 여부를 켜고 끌 수 있음
  • 페이지별 스크린샷도 표시
  • 추출된 Text와 예쁘게 포매팅한 JSON을 각각 복사

구현은 Claude CodeOpus 4.7으로 진행됐다. 먼저 notes.mdplan.md를 만들고, Playwright와 red/green TDD를 포함한 계획을 세운 뒤 작은 커밋을 여러 번 쌓았다. 드롭존 UI, 복사 후 Copied! 표시, Safari 호환성 문제, OCR 기본값 해제 같은 세부 사항을 반복해서 손봤고, 마지막에는 GitHub Actions로 테스트 후 GitHub Pages 배포까지 자동화했다.

마무리 검증은 OpenAI CodexGPT-5.5에 Node.js CLI와 웹 버전의 차이를 설명하게 해 핵심 기능이 빠지지 않았는지 확인하는 방식으로 이뤄졌다. build it 단계는 약 59분 걸렸고, LiteParse 팀과는 아직 상의하지 않아 PR 대신 이슈를 남겼다. 모든 처리가 브라우저 안에서 끝나고 추가 네트워크 요청도 없어서, 이 프로젝트는 비교적 안전한 형태의 vibe coding 사례로 정리된다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.