학습된 화자 목소리로 텍스트를 합성하거나 음성 파일을 변환합니다.
⚠️ 한국어 지시문은 발음으로 새어나옴 (모델 학습이 중국어/영어 위주). 프리셋은 학습-검증된 문장으로 매핑되어 안전합니다. 자유 입력은 영어/중국어로.
낮으면 차분하고 일관된 톤, 높으면 변화 많은 풍부한 표현
낮으면 가장 자연스러운 발음만, 높으면 다양한 발음 시도
매 순간 몇 개의 발음 후보 중에서 고를지
기본값은 빈칸(랜덤). 결과 마음에 들면 아래 표시되는 시드 입력해 재현 가능
업로드 음성 = 변환할 원본 (당신이 올린 파일). 선택한 화자 = 변환된 결과의 음색 (위 드롭다운에서 선택).
학습이 진행될수록 음색은 더 비슷해지지만 발음 어색함도 늘 수 있음. 기본값은 최종 단계
업로드 음성과 선택한 화자의 성별이 다를 때 조정 (남↔여 = ±12, 같은 성별 = 0)
높을수록 선택한 화자 음색에 가까워짐 (1=최대). 너무 높으면 발음이 뻣뻣해질 수 있음
높을수록 업로드 음성의 ㅅ·ㅎ·숨소리가 그대로 남음 (0.5=완전 보존, 0=완전 변환)
피치 떨림 평탄화 (0=업로드 그대로, 클수록 부드러움)
0=업로드 음성의 강약을 유지 / 1=선택한 화자의 평균 음량 패턴을 따라감
단일 파일 → wav 다운로드. 여러 파일 → zip 다운로드.