Skip to main content
POST
cURL (스트리밍 + 재생)

인증

X-API-KEY
string
header
필수

인증을 위한 API 키. 타입캐스트 API 콘솔에서 API 키를 생성할 수 있습니다.

본문

application/json

스트리밍 텍스트 음성 변환 요청 파라미터

voice_id
string
필수

보이스 식별자. 두 가지 prefix 를 지원합니다.

  • tc_ — 기본 제공되는 타입캐스트 보이스 (예: tc_60e5426de8b95f1d3000d7b5). 사용 가능한 ID 는 보이스 목록 조회 를 참조하세요.
  • uc_퀵 클로닝 으로 생성한 커스텀 보이스 (예: uc_64a1b2c3d4e5f6a7b8c9d0e1). 본인이 소유한 클로닝 보이스만 사용할 수 있습니다.

대소문자 구분: prefix 는 소문자만 사용합니다.

예시:

"tc_60e5426de8b95f1d3000d7b5"

text
string
필수

음성으로 변환할 텍스트. 최소 1자, 최대 2000자. 텍스트 길이에 따라 크레딧이 소비됩니다. 영어, 한국어, 일본어, 중국어를 포함한 여러 언어를 지원합니다. 특수 문자와 구두점은 자동으로 처리됩니다.

Required string length: 1 - 2000
예시:

"모든 것이 너무나 완벽해서 마치 꿈을 꾸는 것 같습니다."

model
enum<string>
필수

음성 합성에 사용할 보이스 모델.

  • ssfm-v30: 향상된 플로우와 추가 감정 프리셋이 있는 최신 모델(권장)
  • ssfm-v21: 빠르고 안정적인 모델로 신뢰할 수 있는 품질 제공
사용 가능한 옵션:
ssfm-v30,
ssfm-v21
예시:

"ssfm-v30"

language
string

ISO 639-3 표준을 따르는 언어 코드. 대소문자 구분 안 함("KOR"과 "kor" 모두 허용). 제공하지 않으면 텍스트 내용을 기반으로 자동 감지됩니다.

ssfm-v30 지원 언어 (37개)
ssfm-v21 지원 언어 (27개)
예시:

"kor"

prompt
스마트 프롬프트 (ssfm-v30) · object

생성된 음성의 감정 및 스타일 설정.

예시:
output
OutputStream · object

피치(-12 ~ +12 반음), 속도(0.5x ~ 2.0x), 형식(wav/mp3), target_lufs(-70 ~ 0 LUFS) 등 스트리밍 오디오 출력 설정. 참고: 스트리밍 모드에서는 volume을 사용할 수 없습니다.

seed
integer<uint32>

재현 가능한 음성 생성을 위한 부호 없는 정수 시드. 동일한 시드와 동일한 입력 파라미터로 항상 같은 오디오 결과를 생성합니다.

  • 0 이상의 정수만 허용됩니다. 음수 값은 사용할 수 없습니다.
  • 생략하면 서버가 매번 랜덤 시드를 생성하여 약간의 변이가 발생합니다.
필수 범위: 0 <= x <= 4294967295
예시:

42

응답

Success - Returns streaming audio data in chunks

청크 단위 WAV 오디오 스트림(16비트, 모노, 32000 Hz). 첫 번째 청크에는 size 0xFFFFFFFF(스트리밍 표시)의 WAV 헤더와 원시 PCM 데이터가 포함됩니다. 이후 청크에는 PCM 데이터만 포함됩니다.