生成语音
使用 OpenAI 兼容音频接口将文本转换为语音。
使用支持的语音模型与音色,从文本生成流式音频。
POST
/openai/v1/audio/speech请求体
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 文本转语音模型标识。 |
input | string | 是 | 需要合成的文本。 |
voice | string | 是 | 所选服务商支持的音色。 |
response_format | string | 否 | 需要的音频格式,例如 mp3。 |
响应
端点以二进制形式流式返回音频。请根据响应内容类型选择文件扩展名或播放器解码器。
音频转写
使用 POST /openai/v1/audio/transcriptions 并发送 multipart 表单。file 与 model 都是必填项。不要依赖默认转写模型;请从公开模型目录选择当前可用模型。