cURL (파일로 저장)
curl --request POST \
--url https://api.typecast.ai/v1/text-to-speech/compose \
--header 'Content-Type: application/json' \
--header 'X-API-KEY: <api-key>' \
--output output.wav \
--data @- <<EOF
{
"segments": [
{
"type": "tts",
"voice_id": "tc_672c5f5ce59fac2a48faeaee",
"text": "안녕하세요. 오늘의 소식입니다.",
"model": "ssfm-v30",
"language": "kor",
"output": { "audio_format": "wav" }
},
{ "type": "pause", "duration_seconds": 1.5 },
{
"type": "tts",
"voice_id": "tc_66aca22c7d31e45ff05ff418",
"text": "첫 번째 소식을 전해드립니다.",
"model": "ssfm-v30",
"language": "kor",
"output": { "audio_format": "wav" }
}
]
}
EOFimport requests
response = requests.post(
"https://api.typecast.ai/v1/text-to-speech/compose",
headers={"X-API-KEY": "<api-key>"},
json={
"segments": [
{
"type": "tts",
"voice_id": "tc_672c5f5ce59fac2a48faeaee",
"text": "안녕하세요. 오늘의 소식입니다.",
"model": "ssfm-v30",
"language": "kor",
"output": {"audio_format": "wav"},
},
{"type": "pause", "duration_seconds": 1.5},
{
"type": "tts",
"voice_id": "tc_66aca22c7d31e45ff05ff418",
"text": "첫 번째 소식을 전해드립니다.",
"model": "ssfm-v30",
"language": "kor",
"output": {"audio_format": "wav"},
},
]
},
timeout=120,
)
response.raise_for_status()
with open("output.wav", "wb") as audio_file:
audio_file.write(response.content)const options = {
method: 'POST',
headers: {'X-API-KEY': '<api-key>', 'Content-Type': 'application/json'},
body: JSON.stringify({
segments: [
{
type: 'tts',
voice_id: 'tc_672c5f5ce59fac2a48faeaee',
text: '안녕하세요. 오늘의 소식입니다.',
model: 'ssfm-v30',
language: 'kor',
output: {audio_format: 'wav'}
},
{type: 'pause', duration_seconds: 1.5},
{
type: 'tts',
voice_id: 'tc_66aca22c7d31e45ff05ff418',
text: '첫 번째 소식을 전해드립니다.',
model: 'ssfm-v30',
language: 'kor',
output: {audio_format: 'wav'}
}
]
})
};
fetch('https://api.typecast.ai/v1/text-to-speech/compose', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.typecast.ai/v1/text-to-speech/compose",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'segments' => [
[
'type' => 'tts',
'voice_id' => 'tc_672c5f5ce59fac2a48faeaee',
'text' => '안녕하세요. 오늘의 소식입니다.',
'model' => 'ssfm-v30',
'language' => 'kor',
'output' => [
'audio_format' => 'wav'
]
],
[
'type' => 'pause',
'duration_seconds' => 1.5
],
[
'type' => 'tts',
'voice_id' => 'tc_66aca22c7d31e45ff05ff418',
'text' => '첫 번째 소식을 전해드립니다.',
'model' => 'ssfm-v30',
'language' => 'kor',
'output' => [
'audio_format' => 'wav'
]
]
]
]),
CURLOPT_HTTPHEADER => [
"Content-Type: application/json",
"X-API-KEY: <api-key>"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.typecast.ai/v1/text-to-speech/compose"
payload := strings.NewReader("{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("X-API-KEY", "<api-key>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.typecast.ai/v1/text-to-speech/compose")
.header("X-API-KEY", "<api-key>")
.header("Content-Type", "application/json")
.body("{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.typecast.ai/v1/text-to-speech/compose")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["X-API-KEY"] = '<api-key>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}"
response = http.request(request)
puts response.read_body"[Binary audio data - WAV file content]"{
"detail": "Invalid API key"
}{
"detail": "Insufficient credit"
}{
"detail": "Invalid request format"
}{
"detail": "An unexpected error occurred"
}Text-to-Speech
조합형 텍스트 음성 변환(Compose TTS)
여러 음성 구간과 쉼을 하나의 오디오 파일로 생성합니다. segments 배열에 tts와 pause 객체를 재생할 순서대로 넣으세요. 각 tts 세그먼트는 POST /v1/text-to-speech와 동일한 보이스, 모델, 감정, 출력 설정을 지원하며 세그먼트마다 다른 보이스와 모델을 사용할 수 있습니다.
제한
- 전체 세그먼트는 최대 50개이며
tts세그먼트가 최소 1개 필요합니다. - 모든
tts세그먼트의 텍스트 합은 최대 2,000자입니다. - 쉼은 개별 최대 10초, 전체 합계 최대 60초입니다.
- 모든
tts세그먼트의audio_format은 같아야 합니다.
크레딧은 tts 텍스트 길이의 합만큼 차감되며 쉼에는 차감되지 않습니다. 세그먼트는 병렬로 합성된 뒤 입력 순서대로 반환됩니다. 하나라도 합성에 실패하면 전체 요청이 실패하며 크레딧은 차감되지 않습니다.
응답
성공하면 JSON이 아닌 합성된 오디오 바이너리 데이터를 직접 반환합니다. 응답의 Content-Type은 세그먼트에서 요청한 audio_format에 따라 audio/wav 또는 audio/mpeg입니다.
POST
/
v1
/
text-to-speech
/
compose
cURL (파일로 저장)
curl --request POST \
--url https://api.typecast.ai/v1/text-to-speech/compose \
--header 'Content-Type: application/json' \
--header 'X-API-KEY: <api-key>' \
--output output.wav \
--data @- <<EOF
{
"segments": [
{
"type": "tts",
"voice_id": "tc_672c5f5ce59fac2a48faeaee",
"text": "안녕하세요. 오늘의 소식입니다.",
"model": "ssfm-v30",
"language": "kor",
"output": { "audio_format": "wav" }
},
{ "type": "pause", "duration_seconds": 1.5 },
{
"type": "tts",
"voice_id": "tc_66aca22c7d31e45ff05ff418",
"text": "첫 번째 소식을 전해드립니다.",
"model": "ssfm-v30",
"language": "kor",
"output": { "audio_format": "wav" }
}
]
}
EOFimport requests
response = requests.post(
"https://api.typecast.ai/v1/text-to-speech/compose",
headers={"X-API-KEY": "<api-key>"},
json={
"segments": [
{
"type": "tts",
"voice_id": "tc_672c5f5ce59fac2a48faeaee",
"text": "안녕하세요. 오늘의 소식입니다.",
"model": "ssfm-v30",
"language": "kor",
"output": {"audio_format": "wav"},
},
{"type": "pause", "duration_seconds": 1.5},
{
"type": "tts",
"voice_id": "tc_66aca22c7d31e45ff05ff418",
"text": "첫 번째 소식을 전해드립니다.",
"model": "ssfm-v30",
"language": "kor",
"output": {"audio_format": "wav"},
},
]
},
timeout=120,
)
response.raise_for_status()
with open("output.wav", "wb") as audio_file:
audio_file.write(response.content)const options = {
method: 'POST',
headers: {'X-API-KEY': '<api-key>', 'Content-Type': 'application/json'},
body: JSON.stringify({
segments: [
{
type: 'tts',
voice_id: 'tc_672c5f5ce59fac2a48faeaee',
text: '안녕하세요. 오늘의 소식입니다.',
model: 'ssfm-v30',
language: 'kor',
output: {audio_format: 'wav'}
},
{type: 'pause', duration_seconds: 1.5},
{
type: 'tts',
voice_id: 'tc_66aca22c7d31e45ff05ff418',
text: '첫 번째 소식을 전해드립니다.',
model: 'ssfm-v30',
language: 'kor',
output: {audio_format: 'wav'}
}
]
})
};
fetch('https://api.typecast.ai/v1/text-to-speech/compose', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.typecast.ai/v1/text-to-speech/compose",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'segments' => [
[
'type' => 'tts',
'voice_id' => 'tc_672c5f5ce59fac2a48faeaee',
'text' => '안녕하세요. 오늘의 소식입니다.',
'model' => 'ssfm-v30',
'language' => 'kor',
'output' => [
'audio_format' => 'wav'
]
],
[
'type' => 'pause',
'duration_seconds' => 1.5
],
[
'type' => 'tts',
'voice_id' => 'tc_66aca22c7d31e45ff05ff418',
'text' => '첫 번째 소식을 전해드립니다.',
'model' => 'ssfm-v30',
'language' => 'kor',
'output' => [
'audio_format' => 'wav'
]
]
]
]),
CURLOPT_HTTPHEADER => [
"Content-Type: application/json",
"X-API-KEY: <api-key>"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.typecast.ai/v1/text-to-speech/compose"
payload := strings.NewReader("{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("X-API-KEY", "<api-key>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.typecast.ai/v1/text-to-speech/compose")
.header("X-API-KEY", "<api-key>")
.header("Content-Type", "application/json")
.body("{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.typecast.ai/v1/text-to-speech/compose")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["X-API-KEY"] = '<api-key>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"segments\": [\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_672c5f5ce59fac2a48faeaee\",\n \"text\": \"안녕하세요. 오늘의 소식입니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n },\n {\n \"type\": \"pause\",\n \"duration_seconds\": 1.5\n },\n {\n \"type\": \"tts\",\n \"voice_id\": \"tc_66aca22c7d31e45ff05ff418\",\n \"text\": \"첫 번째 소식을 전해드립니다.\",\n \"model\": \"ssfm-v30\",\n \"language\": \"kor\",\n \"output\": {\n \"audio_format\": \"wav\"\n }\n }\n ]\n}"
response = http.request(request)
puts response.read_body"[Binary audio data - WAV file content]"{
"detail": "Invalid API key"
}{
"detail": "Insufficient credit"
}{
"detail": "Invalid request format"
}{
"detail": "An unexpected error occurred"
}인증
인증을 위한 API 키. 타입캐스트 API 콘솔에서 API 키를 생성할 수 있습니다.
본문
application/json
음성과 쉼 세그먼트를 순서대로 합성하여 하나의 오디오 파일로 반환하는 요청입니다.
출력 순서대로 나열한 음성과 쉼 세그먼트입니다. 최소 1개, 최대 50개이며 tts 세그먼트가 적어도 하나 필요합니다.
Required array length:
1 - 50 elements일반 텍스트 음성 변환 요청과 동일한 합성 옵션을 사용하는 음성 세그먼트입니다.
- TTSComposeSegment
- PauseComposeSegment
Show child attributes
Show child attributes
예시:
{
"type": "tts",
"voice_id": "tc_672c5f5ce59fac2a48faeaee",
"text": "안녕하세요. 오늘의 소식입니다.",
"model": "ssfm-v30",
"language": "kor",
"output": { "audio_format": "wav" }
}
응답
요청한 audio_format에 맞는 바이너리 합성 오디오 데이터
The response is of type file.
⌘I