도구별 실전 가이드 · 공식 정보 확인 2026-08-20
Speech-AI-Forge AGPL-3.0 오픈소스 조건과 시작 절차
작성: gentive · 편집·검수 책임: 신유빈 · 지원 환경: Self-hosted, Web · 페이지 갱신: · 운영·편집 기준
여러 TTS 모델을 Gradio WebUI와 API 서버에서 선택해 음성을 생성한다.
여러 TTS 모델을 Gradio WebUI와 API 서버에서 선택해 음성을 생성한다. Speech-AI-Forge의 첫 실전 과제는 “기본 음성으로 한 문단을 합성하고 속도·발음을 비교한다”이며, 이 흐름을 직접 통제할 사람에게 맞습니다.
이럴 때 맞습니다
- “오늘 서비스 점검은 오후 열한 시에 시작됩니다” 같은 입력으로 Speech-AI-Forge의 핵심 기능을 시험하려는 사람
- 숫자와 고유명사가 정확히 발음되고 API 결과와 UI 재생 파일이 같은지 확인한다. 기준으로 Speech-AI-Forge 결과를 직접 검수할 수 있는 경우
- Self-hosted·Web 환경에서 AGPL-3.0 코드를 직접 설치·관리하려는 작업
이럴 때는 멈추세요
- 셀프호스트 웹 앱 설치·모델 준비·업데이트를 관리하지 않고 즉시 완성된 서비스를 원하는 경우
- 다음 위험을 사람이 확인할 수 없는 작업: 외부 공개 API로 열거나 음성 복제 모델을 사용하면 무단 사칭과 GPU 자원 남용 위험이 있다.
참고 시작점
팩트시트 · 작업 근거 확인 필요: 아래 문구는 공식 제품 사실을 정리한 참고 시작점이며, 성공 결과를 보장하는 검증 절차가 아닙니다.
WebUI에서 안내문 한 문단을 합성한다
숫자와 고유명사를 또렷하게 읽는 기준 음성 파일이 생긴다.
참고 시작점: ‘오늘 서비스 점검은 오후 열한 시에 시작됩니다’를 기본 한국어 음성으로 읽어 줘.
- Gradio-based WebUI에서 기본 한국어 음성과 출력 형식을 고르고 대본을 붙인다.
- 오후 열한 시에 자연스러운 멈춤이 생기도록 SSML을 최소한으로 적용한다.
- 합성 전에 API Server의 외부 공개를 끄고 한 건만 생성해 파일을 재생한다.
UI와 API의 같은 요청을 맞춰 본다
같은 CosyVoice 설정이 UI와 API에서 동일한 발음과 길이를 낸다.
참고 시작점: 같은 안내문과 음성·속도를 API Server에서도 합성해 WebUI 결과와 비교해 줘.
- Gradio 결과의 CosyVoice 모델·음성·속도와 SSML 대본을 기록한다.
- 동일 값을 API Server 요청에 넣고 새 출력 파일로 저장한다.
- 두 파일의 재생 길이·샘플레이트·숫자 발음을 비교해 설정 누락을 찾는다.
복제 음성과 공개 호출을 잠근다
승인한 기본 음성만 내부에서 호출되는 제한된 TTS 서비스가 남는다.
참고 시작점: 음성 복제 모델을 비활성화하고 WebUI와 API를 내부 주소에서만 사용할 수 있게 점검해 줘.
- Gradio-based WebUI에서 동의받지 않은 음성 샘플과 복제 확장을 비활성화한다.
- CosyVoice 호출 수와 GPU 동시 작업 한도를 설정하고 익명 API 요청을 거부한다.
- SSML 대본과 생성 파일에 민감 정보가 없는지 확인한 뒤 시험 로그와 임시 음성을 삭제한다.
무료 조건과 주의점
AGPL-3.0 오픈소스 소프트웨어는 횟수 제한 없이 실행 가능. 연결한 모델 API·서버·GPU 비용은 별도
AGPL-3.0 오픈소스 소프트웨어는 횟수 제한 없이 실행 가능. 연결한 모델 API·서버·GPU 비용은 별도
AGPL-3.0 라이선스의 고지·소스 공개·동일 라이선스 등 조건을 확인해야 합니다.
외부 공개 API로 열거나 음성 복제 모델을 사용하면 무단 사칭과 GPU 자원 남용 위험이 있다.
직접 대안과 비교
- TTS-WebUI — TTS-WebUI도 직접 쓴 문단을 선택한 TTS 모델로 합성하고 속도·발음·클리핑을 재생해 비교할 수 있다.
- VoiceStudio — VoiceStudio에서도 같은 안내문을 기본 음성과 속도로 합성해 다운로드 가능한 오디오로 검수할 수 있다.
공식 근거와 확인일
| 확인 항목 | 확인한 내용 | 공식 출처·확인일 |
|---|---|---|
| 제품 정보 | 여러 TTS 모델을 Gradio WebUI와 API 서버에서 선택해 음성을 생성한다. | Speech-AI-Forge 공식 사이트 |
| 무료 조건 | AGPL-3.0 오픈소스 소프트웨어는 횟수 제한 없이 실행 가능. 연결한 모델 API·서버·GPU 비용은 별도 | 공식 무료 정책·요금 안내 |
| 공식 코드 라이선스 | 오픈소스 코드의 사용·수정·재배포 조건 | 공식 코드 라이선스 |
| 공식 제품 페이지 | 여러 TTS 모델을 Gradio WebUI와 API 서버에서 선택해 음성을 생성한다. | 공식 제품 페이지 |