새 엔드포인트: POST /v1/text-to-speech/with-timestamps
단일 응답으로 합성된 오디오와 단어·문자 단위 정렬 데이터를 함께 반환합니다. 자동 자막, 가라오케 하이라이트, 립싱크 애니메이션 등에 활용하기 좋습니다.granularity 파라미터:granularity는 선택 파라미터이며, 생략하면 단어 단위 정렬과 문자 단위 정렬을 함께 응답합니다.캡션 분할 규칙: 문장 종결 기호(
. ? ! 。 ? !)에서 분할하며, 큐당 7초/42자 상한선을 적용합니다(BBC/Netflix 자막 가이드라인).SDK 업데이트 — 타임스탬프 TTS 전 11개 SDK에 추가
모든 SDK 응답 객체에는
toSrt() / toVtt() 자막 내보내기 헬퍼와 saveAudio(path) / audio_bytes() 편의 메서드가 포함되어 있습니다.새 엔드포인트: POST /v1/text-to-speech/stream
전체 합성을 기다리지 않고 생성되는 오디오 청크를 실시간으로 전달하는 저지연 스트리밍 엔드포인트가 추가되었습니다./v1/text-to-speech와의 주요 차이점:요청 스키마:
audio/wav 또는 audio/mpeg).새 엔드포인트: GET /v1/users/me/subscription
인증된 사용자의 플랜 등급, 크레딧 사용량, 동시 요청 제한을 조회합니다.SDK 업데이트
9개 공식 SDK 모두 스트리밍 및 구독 지원이 추가되었습니다:새 모델: ssfm-v30
음성 품질이 개선되고 기능이 확장된 새로운ssfm-v30 모델 지원이 추가되었습니다.새로운 기능:- 스마트 이모션 -
SmartPrompt를 사용한 문맥 인식 감정 추론 - 7가지 감정 프리셋 -
whisper,toneup,tonedown프리셋 추가 - 범용 감정 지원 - 모든 감정을 모든 보이스에서 사용 가능
- 37개 언어 - 10개 새 언어 추가
새 엔드포인트: GET /v2/voices
모델별로 그룹화된 감정과 추가 메타데이터가 포함된 향상된 보이스 목록 엔드포인트가 추가되었습니다.응답 스키마:
지원 중단: 보이스 관리 엔드포인트
다음 엔드포인트가 지원 중단되어 제거되었습니다:향상된 메타데이터가 포함된 보이스 목록을 보려면
GET /v2/voices를 사용하세요.초기 출시: ssfm-v21
ssfm-v21 모델로 타입캐스트 Text-to-Speech API를 출시했습니다.엔드포인트:기능:
- 저지연 음성 합성
- 4가지 감정 프리셋:
normal,happy,sad,angry - 음성에 따라 감정 사용 가능 여부가 다름
- 27개 언어 지원