도구별 실전 가이드 · 공식 정보 확인 2026-08-20
Pandrator 사용법: 무료로 시작하는 가장 현실적인 방법
PDF·EPUB를 음성책으로 만들고 자막·영상을 번역해 복제 음성으로 더빙하는 문서 오디오북과 번역 더빙을 만드는 로컬 음성 제작 GUI입니다. Pandrator의 첫 실전 과제는 “공개 도메인 단편 PDF 첫 장을 두 화자 오디오북으로 만들기”이며, 이 흐름을 직접 통제할 사람에게 맞습니다.
이럴 때 맞습니다
- “화자 구분이 있는 공개 도메인 PDF와 사용 허가된 음성 표본” 같은 입력으로 Pandrator의 핵심 기능을 시험하려는 사람
- 문단·화자 순서와 페이지 누락 여부, 긴 문장의 발음·쉼이 원문과 맞는지 기준으로 Pandrator 결과를 직접 검수할 수 있는 경우
- Desktop 환경에서 MIT 코드를 직접 설치·관리하려는 작업
이럴 때는 멈추세요
- 문서 오디오북과 번역 더빙을 만드는 로컬 음성 제작 GUI 설치·모델 준비·업데이트를 관리하지 않고 즉시 완성된 서비스를 원하는 경우
- 다음 위험을 사람이 확인할 수 없는 작업: 동의 없는 음성 복제와 번역 더빙으로 초상·저작권을 침해하거나 로컬 모델 학습 파일이 큰 저장 공간을 차지하는 위험.
처음 해볼 작업 3가지
공개 도메인 PDF와 화자 문단을 분리한다
첫 장의 문단·화자·권리 상태가 명확해진다.
두 음성으로 문단을 합성한다
화자 전환과 긴 문장 쉼이 반영된 오디오 조각이 생긴다.
오디오북 순서와 저장 공간을 검수한다
페이지 누락과 화자 뒤바뀜이 없는 첫 장 오디오북이 남는다.
무료 조건과 주의점
MIT 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
MIT 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
MIT 저장소 코드는 상업적으로 사용할 수 있지만, 모델 가중치·입력 자료·생성물·번들 자산의 권리는 각각 따로 확인해야 합니다.
동의 없는 음성 복제와 번역 더빙으로 초상·저작권을 침해하거나 로컬 모델 학습 파일이 큰 저장 공간을 차지하는 위험.
직접 대안과 비교
- Kokoro-FastAPI — 다중 화자 TTS·음색 혼합·자동 연결과 타임스탬프를 지원하므로, PDF 문단을 먼저 추출하면 같은 두 화자 낭독 오디오를 API와 WebUI로 만든다.