文本转语音(原生OpenAI格式)
将文本合成为语音音频,返回二进制音频流。同一分组内还有音频转录、音频翻译,以及 Gemini 原生格式。
接口地址
POST /v1/audio/speech请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 语音合成模型标识,如 tts-1 |
input | string | 是 | 要合成的文本 |
voice | string | 是 | 音色,如 alloy |
response_format | string | 否 | mp3(默认)/ opus / aac / flac / wav |
speed | number | 否 | 语速,0.25~4.0,默认 1.0 |
请求示例
bash
curl https://ai.youqi.tech/v1/audio/speech \
-H "Authorization: Bearer sk-YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1",
"input": "你好,欢迎使用 YouQi AI。",
"voice": "alloy"
}' \
--output speech.mp3提示
音频接口的可用性取决于所选模型。返回为二进制音频流,客户端需直接保存 / 播放响应体。