도구별 실전 가이드 · 공식 정보 확인 2026-08-20
aTrain 사용법: 무료로 시작하는 가장 현실적인 방법
Whisper 기반으로 음성 녹음을 기기 안에서 전사하고 화자별 구간을 나눠 질적 분석 도구용 결과를 내보낸다. aTrain의 첫 실전 과제는 “두 사람이 대화한 5분짜리 동의된 샘플을 화자 감지와 함께 전사한다”이며, 이 흐름을 직접 통제할 사람에게 맞습니다.
이럴 때 맞습니다
- “화자 A와 B가 번갈아 말하는 한국어 인터뷰 MP3, 예상 화자 수 2명” 같은 입력으로 aTrain의 핵심 기능을 시험하려는 사람
- 시간표시가 오디오 위치와 맞고 화자 전환 열 곳 중 대부분이 올바르게 구분된다. 기준으로 aTrain 결과를 직접 검수할 수 있는 경우
- Windows·Linux·Desktop·CLI 환경에서 AGPL-3.0 코드를 직접 설치·관리하려는 작업
이럴 때는 멈추세요
- 인터뷰 화자 분리형 오프라인 전사 GUI·CLI 설치·모델 준비·업데이트를 관리하지 않고 즉시 완성된 서비스를 원하는 경우
- 다음 위험을 사람이 확인할 수 없는 작업: 오프라인 처리라도 인터뷰 녹음의 수집·보관 동의가 필요하며 화자 분리 오류를 연구 코딩이나 인용에 사용하기 전 사람이 교정해야 한다.
처음 해볼 작업 3가지
인터뷰 오디오와 화자 수 준비
동의된 5분 WAV와 예상 화자 두 명이 새 프로젝트에 등록된다.
화자 분리 전사 실행
오프라인 처리 뒤 두 화자의 발화 구간과 텍스트가 생성된다.
구간·화자·누락 대조
표본 구간의 화자와 문장이 원음과 맞고 외부 업로드가 없다.
무료 조건과 주의점
AGPL-3.0 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
AGPL-3.0 오픈소스 소프트웨어로 로컬 실행 횟수 제한 없음. 모델 다운로드와 GPU·전기 비용은 사용자 부담
AGPL-3.0 라이선스의 고지·소스 공개·동일 라이선스 등 조건을 확인해야 합니다.
오프라인 처리라도 인터뷰 녹음의 수집·보관 동의가 필요하며 화자 분리 오류를 연구 코딩이나 인용에 사용하기 전 사람이 교정해야 한다.
직접 대안과 비교
- noScribe — noScribe도 로컬 Whisper 전사와 화자 분리로 같은 인터뷰 WAV를 처리한다.
- TranscriptionSuite — TranscriptionSuite도 녹음 파일을 오프라인에서 전사하고 화자·타임스탬프 결과를 낸다.