音频转录(原生OpenAI格式)
将音频转写为同语种文本。同一分组内还有文本转语音、音频翻译,以及 Gemini 原生格式。
接口地址
POST /v1/audio/transcriptions使用 multipart/form-data 上传音频文件。
请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
file | file | 是 | 音频文件(mp3 / wav / m4a 等) |
model | string | 是 | 识别模型标识,如 whisper-1 |
language | string | 否 | 音频语言(ISO-639-1),可提升准确率 |
response_format | string | 否 | json(默认)/ text / srt / vtt |
temperature | number | 否 | 采样温度,默认 0 |
请求示例
bash
curl https://ai.youqi.tech/v1/audio/transcriptions \
-H "Authorization: Bearer sk-YOUR_API_KEY" \
-F file="@audio.mp3" \
-F model="whisper-1"响应示例
json
{ "text": "这是识别出的文本内容。" }提示
二进制上传请使用 multipart/form-data,不要设置为 JSON。