도구별 실전 가이드 · 공식 정보 확인 2026-08-20
mdflux 사용법: 무료로 시작하는 가장 현실적인 방법
스캔 PDF와 폴더 묶음을 오프라인 OCR로 읽어 정돈된 Markdown으로 변환하는 스캔 문서를 AI용 Markdown으로 바꾸는 로컬 데스크톱 앱입니다. mdflux의 첫 실전 과제는 “스캔한 회의 자료 폴더를 제목·표가 보존된 Markdown으로 일괄 변환하기”이며, 이 흐름을 직접 통제할 사람에게 맞습니다.
이럴 때 맞습니다
- “기울어진 페이지와 표가 섞인 스캔 PDF 다섯 개” 같은 입력으로 mdflux의 핵심 기능을 시험하려는 사람
- 페이지별 제목 계층·표의 행열·본문 순서가 원본과 대응하는지 기준으로 mdflux 결과를 직접 검수할 수 있는 경우
- Desktop 환경에서 MIT 코드를 직접 설치·관리하려는 작업
이럴 때는 멈추세요
- 스캔 문서를 AI용 Markdown으로 바꾸는 로컬 데스크톱 앱 설치·모델 준비·업데이트를 관리하지 않고 즉시 완성된 서비스를 원하는 경우
- 다음 위험을 사람이 확인할 수 없는 작업: 저화질 스캔의 숫자와 표 셀이 잘못 인식돼 RAG가 틀린 사실을 검색하는 문제.
처음 해볼 작업 3가지
스캔 폴더를 변환 대기열로 묶는다
기울기와 표가 섞인 PDF 다섯 개가 로컬 일괄 작업에 들어간다.
OCR 결과를 문서 구조로 만든다
제목 계층과 표가 살아 있는 AI-ready Markdown이 생긴다.
RAG 투입 전 숫자를 감사한다
검색에 넣어도 되는 Markdown과 재검수 문서가 구분된다.
무료 조건과 주의점
MIT 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
MIT 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
MIT 저장소 코드는 상업적으로 사용할 수 있지만, 모델 가중치·입력 자료·생성물·번들 자산의 권리는 각각 따로 확인해야 합니다.
저화질 스캔의 숫자와 표 셀이 잘못 인식돼 RAG가 틀린 사실을 검색하는 문제.
직접 대안과 비교
- paddleocr-local — PDF·Office 문서를 로컬 OCR 모델로 Markdown 변환하고 모델별 결과를 비교하므로, 스캔 PDF 폴더의 제목·표 보존 과제를 WebUI나 CLI로 대체한다.