Skip to main content

인증 시작하기

타입캐스트 API를 사용하려면 API 키로 요청을 인증해야 합니다. 다음 단계를 따르세요:
1

첫 번째 단계

타입캐스트 API 콘솔을 방문하여 새 API 키를 생성하세요
2

두 번째 단계

API 키를 안전하게 보관하세요 - 환경 변수로 저장하는 것을 권장합니다

첫 번째 요청 실행하기

1

SDK 설치

모든 SDK는 최신 버전이 필요합니다.
  • Python: 이전 버전이 있다면 pip install --upgrade typecast-python으로 업그레이드하세요
  • Javascript: 이전 버전이 있다면 npm update @neosapience/typecast-js로 업그레이드하세요
  • C#: dotnet add package typecast-csharp로 업데이트하세요
  • Java: pom.xml 또는 build.gradle에서 버전을 업데이트하세요
  • Kotlin: build.gradle.kts에서 버전을 업데이트하세요
  • Rust: Cargo.toml에서 버전을 업데이트하세요
음성 합성과 오디오 파일 저장만 필요하다면 SDK의 generateToFile 또는 generate_to_file 헬퍼를 사용하세요. 각 SDK 페이지에서 언어별 예시를 확인할 수 있습니다.
2

가져오기 및 초기화

요청에 사용할 수 있는 Voice ID를 찾아보려면 API 레퍼런스의 보이스 목록 조회를 참조하세요.

모든 보이스 목록 조회하기

타입캐스트를 효과적으로 사용하려면 Voice ID에 액세스해야 합니다. /v2/voices 엔드포인트는 고유 식별자, 이름, 지원 모델 및 감정이 포함된 사용 가능한 보이스의 전체 목록을 제공합니다. 모델, 성별, 연령대 및 사용 사례 등의 선택적 쿼리 파라미터를 사용하여 보이스를 필터링할 수 있습니다.
보이스 페이지에서 API 호출 없이 API에서 사용할 수 있는 보이스 목록과 샘플 음성을 미리 보고 들어볼 수 있습니다. 먼저 보이스를 비교한 뒤, 사용할 Voice ID를 API 요청에 넣어주세요.
응답은 각각 다음을 포함하는 음성 객체의 JSON 배열입니다:
텍스트 음성 변환 요청을 할 때 유효한 Voice ID가 필요합니다. ssfm-v30을 사용하면 모든 7가지 감정 프리셋을 모든 보이스에서 사용할 수 있습니다.

실시간 오디오 스트리밍

저지연 애플리케이션의 경우, 스트리밍 엔드포인트를 사용하여 전체 합성을 기다리지 않고 오디오 청크가 도착하는 즉시 재생할 수 있습니다. WAV 스트리밍 형식: 32000 Hz, 16비트, 모노 PCM. 첫 번째 청크에 44바이트 WAV 헤더가 포함되며, 이후 청크는 원시 PCM 데이터만 포함합니다.
더 많은 언어(Go, Rust, Swift, C#, Kotlin, C)의 실시간 재생 예시는 각 SDK 문서를 참조하세요.

타임스탬프 TTS로 자막 생성하기

POST /v1/text-to-speech/with-timestamps를 사용하면 오디오와 함께 단어 단위 정렬 데이터를 받아 자막, 가라오케, 립싱크 애플리케이션을 만들 수 있습니다.
각 언어별 타임스탬프 TTS 사용법은 SDK 문서를 참조하세요. 일본어(jpn), 중국어(zho)는 granularity: "char" (문자 단위) 를 사용해야 합니다.

다음 단계

축하합니다! 첫 번째 AI 음성을 만들었습니다. 더 자세히 알아보려면 다음 리소스를 참조하세요:

API 레퍼런스

타입캐스트 API 사용 방법 알아보기

모델

ssfm-v30 및 ssfm-v21 모델에 대해 알아보기

변경 로그

최신 API 변경 사항 및 업데이트 확인