VoiceChanger

학습된 화자 목소리로 텍스트를 합성하거나 음성 파일을 변환합니다.

화자 선택

텍스트 입력
고급 옵션 (GPT-SoVITS)

낮으면 차분하고 일관된 톤, 높으면 변화 많은 풍부한 표현

낮으면 가장 자연스러운 발음만, 높으면 다양한 발음 시도

매 순간 몇 개의 발음 후보 중에서 고를지

기본값은 빈칸(랜덤). 결과 마음에 들면 아래 표시되는 시드 입력해 재현 가능

오디오 업로드 (다중 파일 가능)

업로드 음성 = 변환할 원본 (당신이 올린 파일). 선택한 화자 = 변환된 결과의 음색 (위 드롭다운에서 선택).

학습이 진행될수록 음색은 더 비슷해지지만 발음 어색함도 늘 수 있음. 기본값은 최종 단계

업로드 음성과 선택한 화자의 성별이 다를 때 조정 (남↔여 = ±12, 같은 성별 = 0)

고급 옵션

높을수록 선택한 화자 음색에 가까워짐 (1=최대). 너무 높으면 발음이 뻣뻣해질 수 있음

높을수록 업로드 음성의 ㅅ·ㅎ·숨소리가 그대로 남음 (0.5=완전 보존, 0=완전 변환)

피치 떨림 평탄화 (0=업로드 그대로, 클수록 부드러움)

0=업로드 음성의 강약을 유지 / 1=선택한 화자의 평균 음량 패턴을 따라감

단일 파일 → wav 다운로드. 여러 파일 → zip 다운로드.

이력 (생성된 음성 보존)