개발 문서
음성 합성
텍스트를 음성으로 만듭니다. 안내 음성과 알림 읽기에 씁니다.
호출
POST /audio/speech에 input과 voice를 넘깁니다. 응답은 오디오 바이너리입니다.
| Field | Type | Note |
|---|---|---|
| input | string | Text to speak |
| voice | string | Model dependent |
| response_format | string | mp3 | wav | pcm |
| speed | number | 0.5–2.0 |
스트리밍
stream_format을 지정하면 생성되는 대로 흘려보냅니다. 긴 문장의 체감 지연을 줄입니다.
발화 제어
speed로 속도를 조절합니다. 문장 부호가 끊어 읽기에 그대로 반영되니 원문을 다듬는 편이 낫습니다.