커스텀 보이스
프리미엄 클로닝 생성
WAV 또는 MP3 녹음으로 비동기 프리미엄 보이스 학습을 시작합니다. 녹음, 표시 이름, 지원 TTS 모델, ISO 639-3 언어 코드를 multipart/form-data로 전송하세요.
오디오 요구 사항
- WAV 또는 MP3 파일 1개
- 파일 크기: 1 GiB 이하
- 길이: 5분 이상 3시간 이하
- 샘플레이트: 16 kHz 이상
성공하면 status: training과 함께 202 Accepted를 반환합니다. GET /v1/custom-voices/{voice_id}를 호출하여 상태가 completed 또는 failed가 될 때까지 확인하세요.
학습 완료까지는 최대 2시간이 소요되며, 커스텀 보이스 생성이 완료되거나 실패하면 이메일이 발송됩니다.
POST
/v1/custom-voices/professional-clone인증
X-API-KEYstringheader필수인증을 위한 API 키입니다. Typecast API 콘솔에서 API 키를 발급받을 수 있습니다.
프리미엄 클로닝용 multipart 요청 본문입니다.
namestringrequired최대 30자의 보이스 이름입니다.
filesstring[]required학습에 사용할 WAV 또는 MP3 음성 파일입니다. 하나의 파일을 업로드할 수 있습니다.
업로드 제한
- WAV 또는 MP3 파일 1개
- 파일 크기: 1 GiB 이하
- 길이: 5분 이상 3시간 이하
- 샘플레이트: 16 kHz 이상
최상의 결과를 위해 다음 조건을 충족하는 오디오를 권장합니다.
- 생성된 보이스가 재현하기를 원하는 말투와 최대한 가깝게 녹음해 주세요.
- 배경 소음이 없는 조용한 환경에서 녹음해 주세요.
- 한 명의 화자 목소리만 포함해 주세요.
language필드에 지정한 언어로 녹음해 주세요.- 오디오 길이가 길수록 생성되는 보이스의 품질이 향상됩니다.
modelssfm-v30 | ssfm-v21requiredTTS 모델 버전입니다.
ssfm-v30ssfm-v21languagestringrequiredkor, eng 같은 ISO 639-3 언어 코드입니다.
응답
202프리미엄 클로닝 학습을 시작했습니다.application/json
namestring보이스 이름입니다.
modelstringTTS 모델 버전입니다.
statuspending | training | completed | failed현재 생성 또는 학습 상태입니다.
pendingtrainingcompletedfailedvoice_idstringuc_로 시작하는 커스텀 보이스 고유 식별자입니다.