직접 입력할 때는 영어·중국어로 작성하세요. 한국어 지시는 대사처럼 읽힐 수 있습니다.
낮으면 차분하고 일관된 톤, 높으면 변화 많은 풍부한 표현
낮으면 가장 자연스러운 발음만, 높으면 다양한 발음 시도
매 순간 몇 개의 발음 후보 중에서 고를지
기본값은 빈칸(랜덤). 결과 마음에 들면 아래 표시되는 시드 입력해 재현 가능
녹음의 말투와 타이밍을 살려 선택한 인물의 목소리로 바꿉니다.
학습이 진행될수록 음색은 더 비슷해지지만 발음 어색함도 늘 수 있음. 기본값은 최종 단계
업로드 음성과 선택한 화자의 성별이 다를 때 조정 (남↔여 = ±12, 같은 성별 = 0)
높을수록 선택한 화자 음색에 가까워짐 (1=최대). 너무 높으면 발음이 뻣뻣해질 수 있음
높을수록 업로드 음성의 ㅅ·ㅎ·숨소리가 그대로 남음 (0.5=완전 보존, 0=완전 변환)
피치 떨림 평탄화 (0=업로드 그대로, 클수록 부드러움)
0=업로드 음성의 강약을 유지 / 1=선택한 화자의 평균 음량 패턴을 따라감
단일 파일 → wav 다운로드. 여러 파일 → zip 다운로드.