커스텀 보이스

프리미엄 클로닝 생성

SDK

수동 HTTP 호출보다 안전하고 빠른 통합을 위해 SDK를 사용하세요.

SDK 가이드

WAV 또는 MP3 녹음으로 비동기 프리미엄 보이스 학습을 시작합니다. 녹음, 표시 이름, 지원 TTS 모델, ISO 639-3 언어 코드를 multipart/form-data로 전송하세요.

오디오 요구 사항

  • WAV 또는 MP3 파일 1개
  • 파일 크기: 1 GiB 이하
  • 길이: 5분 이상 3시간 이하
  • 샘플레이트: 16 kHz 이상

성공하면 status: training과 함께 202 Accepted를 반환합니다. GET /v1/custom-voices/{voice_id}를 호출하여 상태가 completed 또는 failed가 될 때까지 확인하세요.

학습 완료까지는 최대 2시간이 소요되며, 커스텀 보이스 생성이 완료되거나 실패하면 이메일이 발송됩니다.

POST/v1/custom-voices/professional-clone

인증

X-API-KEYstringheader필수

인증을 위한 API 키입니다. Typecast API 콘솔에서 API 키를 발급받을 수 있습니다.

본문

multipart/form-data

프리미엄 클로닝용 multipart 요청 본문입니다.

namestringrequired

최대 30자의 보이스 이름입니다.

filesstring[]required

학습에 사용할 WAV 또는 MP3 음성 파일입니다. 하나의 파일을 업로드할 수 있습니다.

업로드 제한

  • WAV 또는 MP3 파일 1개
  • 파일 크기: 1 GiB 이하
  • 길이: 5분 이상 3시간 이하
  • 샘플레이트: 16 kHz 이상

최상의 결과를 위해 다음 조건을 충족하는 오디오를 권장합니다.

  • 생성된 보이스가 재현하기를 원하는 말투와 최대한 가깝게 녹음해 주세요.
  • 배경 소음이 없는 조용한 환경에서 녹음해 주세요.
  • 한 명의 화자 목소리만 포함해 주세요.
  • language 필드에 지정한 언어로 녹음해 주세요.
  • 오디오 길이가 길수록 생성되는 보이스의 품질이 향상됩니다.
modelssfm-v30 | ssfm-v21required

TTS 모델 버전입니다.

ssfm-v30ssfm-v21
languagestringrequired

kor, eng 같은 ISO 639-3 언어 코드입니다.

응답

202프리미엄 클로닝 학습을 시작했습니다.application/json
namestring

보이스 이름입니다.

modelstring

TTS 모델 버전입니다.

statuspending | training | completed | failed

현재 생성 또는 학습 상태입니다.

pendingtrainingcompletedfailed
voice_idstring

uc_로 시작하는 커스텀 보이스 고유 식별자입니다.

⌘I