Voice QA Studio
대본을 목소리로, 목소리를 활용 가능한 자료로.
텍스트와 XLSX 대본을 Supertonic TTS로 합성합니다. 화자별 음성·속도·간격을 설정하고 개별 음원·합본·시간 정보 보고서를 함께 만드세요.
실제 프로그램 UI에 직접 만든 가상 자료를 표시했습니다. 이미지를 누르면 원본 크기로 볼 수 있습니다. 데모 자료로 UI를 렌더링했으며 실제 활동 수집·음성 합성은 실행하지 않았습니다.
어떤 프로그램인가요?
Supertonic TTS를 Windows에서 구동·관리하는 음성 제작 프로그램입니다. 일반 내레이션부터 여러 화자가 참여하는 대화까지 제작하고, 오디오와 대본의 시간 정보를 연결해 STT 평가용 자료나 오디오북 제작에 활용합니다.
주요 기능
일반 텍스트 합성
텍스트를 문장 구간으로 나누고 현재 재생 구간을 강조합니다. 재생·저장·재생과 저장을 선택하고 남녀 화자가 교대로 읽는 대화 모드를 사용할 수 있습니다.
XLSX 대본 편집
대본을 불러오고 행을 추가·삭제하며 화자명·내용·보이스 ID를 편집합니다. 헤더 기준으로 열을 인식하고 기존 7열 양식과 옵션 Style/Pitch 열을 보존합니다.
10가지 보이스와 속도
남성 M1~M5와 여성 F1~F5를 선택하고 행마다 속도를 지정합니다. Style 열과 비고·본문의 태그로 권장 속도·간격을 보조합니다.
대화의 무음 간격
행별 발화 뒤에 실제 PCM 무음을 삽입합니다. 간격이 빈 값·AUTO·-1이면 기본 간격을 사용하고 명시한 값은 우선 적용합니다.
음원과 XLSX 보고서
세그먼트 파일·전체 합본·타임스탬프 보고서를 함께 저장합니다. WAV를 기본으로 사용하고 FFmpeg가 있으면 MP3·FLAC로 저장할 수 있습니다.
긴 합본 스트리밍 저장
긴 대본의 합본은 PCM을 전부 메모리에 쌓지 않고 스트리밍으로 저장합니다. 편집한 대본과 신규 작성용 양식도 XLSX로 저장합니다.
이런 분께 추천합니다
- 오디오북·내레이션·다화자 대화 음원을 만드는 분
- 음성과 정답 대본·시간 정보가 연결된 STT 평가 자료가 필요한 분
이렇게 사용하세요
- 실행 환경과 TTS 모델을 준비하고 텍스트나 XLSX 대본을 불러옵니다.
- 화자별 보이스·속도·간격을 지정하고 재생으로 확인합니다.
- 전체 저장으로 개별 세그먼트·합본·XLSX 보고서를 생성합니다.
- 수정한 대본을 XLSX로 저장해 다음 작업에 다시 사용합니다.
지원 환경
- Windows 10/11 64비트 · C# WPF / .NET 8
- Python 3.10 이상 · 최초 가상환경 구성·패키지 설치·모델 다운로드 인터넷 필요
- MP3·FLAC 출력: FFmpeg를 PATH에 등록 · 다른 PC 배포 시 assets 폴더 필수
공개 배포 안내
공개 배포 전
현재 비공개로 개발 중인 프로그램입니다. 소스 코드와 설치 파일은 아직 공개하지 않았습니다. 공개 배포를 시작하면 이 페이지에서 다운로드 방법을 안내하겠습니다.
사용 전에 알아두세요
Pitch 열은 가져오기·편집·내보내기·보고서에 보존되지만 실제 오디오 피치 후처리는 기본 비활성입니다. 엔진의 직접 피치 제어 기능으로 안내하지 않습니다.
합성 전에 괄호 안 한자와 독립 한자를 제거합니다. 일부 합성 실패는 Windows TTS로 대체되어 보이스가 달라질 수 있으므로 결과 음원을 확인하세요.
처음 실행할 때 가상환경과 패키지를 준비하고 모델을 다운로드합니다. 다른 PC에는 실행 파일과 assets 폴더를 함께 전달해야 합니다.
2026년 10월 8일 저장소 문서 기준으로 정리했습니다. 배포 상태와 요구사항은 이후 변경될 수 있습니다.
