AI Briefing

OpenReader v3.0 공개

GitHub - richardr1126/openreader: An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

·2026.05.17 03:12

다양한 AI TTS 엔진을 지원하고 오디오북 제작이 가능한 오픈소스 문서 리더 OpenReader v3.0이 출시되었습니다.

OpenReader는 EPUB, PDF, TXT, Markdown, DOCX 파일을 읽고 들을 수 있는 Next.js 기반의 오픈소스 웹 애플리케이션입니다.

주요 기능 및 특징:

  • 다양한 TTS 엔진 지원: OpenAI, Replicate, Deepinfra 및 Kokoro-FastAPI, KittenTTS-FastAPI와 같은 자체 호스팅 OpenAI 호환 API를 지원합니다.
  • 자체 호스팅(Self-hosted): 문서, TTS 오디오, 설정 데이터를 사용자의 서버(SQLite, Postgres) 및 객체 스토리지(SeaweedFS, S3)에 직접 관리할 수 있습니다.
  • 오디오북 생성: ffmpeg를 활용해 챕터 메타데이터가 포함된 m4b/mp3 형식의 오디오북을 생성하고 다운로드할 수 있습니다.

v3.0.0 주요 업데이트:

  • 오디오 프리로딩 및 캐싱: 읽기 진행 상황에 맞춰 다음 페이지의 오디오를 미리 로드하며, 서버의 객체 스토리지에 오디오를 캐싱하여 끊김 없는 재생을 지원합니다.
  • 관리자 패널 도입: 여러 TTS 제공업체의 API 키를 관리하고, 서비스 재배포 없이 런타임에서 기능 플래그(사용자 가입, 제공업체 제한 등)를 제어할 수 있습니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.