Skip to content

文本转语音(原生OpenAI格式)

将文本合成为语音音频,返回二进制音频流。同一分组内还有音频转录音频翻译,以及 Gemini 原生格式

接口地址

POST /v1/audio/speech

请求参数

参数类型必填说明
modelstring语音合成模型标识,如 tts-1
inputstring要合成的文本
voicestring音色,如 alloy
response_formatstringmp3(默认)/ opus / aac / flac / wav
speednumber语速,0.25~4.0,默认 1.0

请求示例

bash
curl https://ai.youqi.tech/v1/audio/speech \
  -H "Authorization: Bearer sk-YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1",
    "input": "你好,欢迎使用 YouQi AI。",
    "voice": "alloy"
  }' \
  --output speech.mp3

提示

音频接口的可用性取决于所选模型。返回为二进制音频流,客户端需直接保存 / 播放响应体。