Skip to main content
POST
cURL

인증

X-API-KEY
string
header
필수

인증을 위한 API 키. 타입캐스트 API 콘솔에서 API 키를 생성할 수 있습니다.

쿼리 매개변수

granularity
enum<string>

반환할 타임스탬프 배열을 선택합니다.

  • 생략: wordscharacters 모두 반환
  • word: words 만 반환 (characters 는 null)
  • char: characters 만 반환 (words 는 null)

공백 없는 언어(예: jpn, zho): word 정렬은 문장 전체를 하나의 구간으로 반환하므로, 의미 있는 타임스탬프를 얻으려면 char 를 사용하세요.

사용 가능한 옵션:
word,
char

본문

application/json

TTSRequestWith-timestamps parameters

voice_id
string
필수

보이스 식별자. 두 가지 prefix 를 지원합니다.

  • tc_ — 기본 제공되는 타입캐스트 보이스 (예: tc_60e5426de8b95f1d3000d7b5). 사용 가능한 ID 는 보이스 목록 조회 를 참조하세요.
  • uc_퀵 클로닝 으로 생성한 커스텀 보이스 (예: uc_64a1b2c3d4e5f6a7b8c9d0e1). 본인이 소유한 클로닝 보이스만 사용할 수 있습니다.

대소문자 구분: prefix 는 소문자만 사용합니다.

예시:

"tc_60e5426de8b95f1d3000d7b5"

text
string
필수

음성으로 변환할 텍스트. 최소 1자, 최대 2000자. 텍스트 길이에 따라 크레딧이 소비됩니다. 영어, 한국어, 일본어, 중국어를 포함한 여러 언어를 지원합니다. 특수 문자와 구두점은 자동으로 처리됩니다.

Required string length: 1 - 2000
예시:

"모든 것이 너무나 완벽해서 마치 꿈을 꾸는 것 같습니다."

model
enum<string>
필수

음성 합성에 사용할 보이스 모델.

  • ssfm-v30: 향상된 플로우와 추가 감정 프리셋이 있는 최신 모델(권장)
  • ssfm-v21: 빠르고 안정적인 모델로 신뢰할 수 있는 품질 제공
사용 가능한 옵션:
ssfm-v30,
ssfm-v21
예시:

"ssfm-v30"

language
string

ISO 639-3 표준을 따르는 언어 코드. 대소문자 구분 안 함("KOR"과 "kor" 모두 허용). 제공하지 않으면 텍스트 내용을 기반으로 자동 감지됩니다.

ssfm-v30 지원 언어 (37개)
ssfm-v21 지원 언어 (27개)

타임스탬프 엔드포인트 주의. 일본어(jpn) · 중국어(zho) 처럼 단어 사이에 공백이 없는 언어는 word 단위 정렬이 문장 전체를 하나의 구간으로 묶어 버립니다. 이런 언어에서는 항상 granularity=char 를 함께 지정해 문자 단위 타임스탬프를 받으세요.

예시:

"kor"

prompt
스마트 프롬프트 (ssfm-v30) · object

생성된 음성의 감정 및 스타일 설정.

예시:
output
Output · object

볼륨(0-200), 피치(-12~+12 반음), 템포(0.5배~2.0배), 형식(wav/mp3)을 포함한 오디오 출력 설정으로 최종 오디오 특성을 제어합니다

seed
integer<uint32>

재현 가능한 음성 생성을 위한 부호 없는 정수 시드. 동일한 시드와 동일한 입력 파라미터로 항상 같은 오디오 결과를 생성합니다.

  • 0 이상의 정수만 허용됩니다. 음수 값은 사용할 수 없습니다.
  • 생략하면 서버가 매번 랜덤 시드를 생성하여 약간의 변이가 발생합니다.
필수 범위: 0 <= x <= 4294967295
예시:

42

응답

Success - Returns base64 audio and timestamps

TTS 생성 + 타임스탬프 정렬 통합 응답.

audio
string
필수

base64 로 인코딩된 오디오 바이트. audio_format 확장자로 디코딩해 파일로 저장할 수 있습니다.

audio_format
enum<string>
필수

audio 필드의 오디오 인코딩 포맷 — wav 또는 mp3 (요청의 output.audio_format 에 따라 결정).

사용 가능한 옵션:
wav,
mp3
audio_duration
number
필수

생성된 오디오의 길이(초).

words
AlignmentSegmentWord · object[] | null
필수

단어 단위 타임스탬프(문장부호 포함). 요청이 granularity=char 일 때는 null.

characters
AlignmentSegmentCharacter · object[] | null
필수

문자 단위 타임스탬프(문장부호와 공백 포함). 요청이 granularity=word 일 때는 null.