生成语音

使用 OpenAI 兼容音频接口将文本转换为语音。

使用支持的语音模型与音色,从文本生成流式音频。

POST/openai/v1/audio/speech

请求体

字段类型必填说明
modelstring文本转语音模型标识。
inputstring需要合成的文本。
voicestring所选服务商支持的音色。
response_formatstring需要的音频格式,例如 mp3

响应

端点以二进制形式流式返回音频。请根据响应内容类型选择文件扩展名或播放器解码器。

音频转写

使用 POST /openai/v1/audio/transcriptions 并发送 multipart 表单。filemodel 都是必填项。不要依赖默认转写模型;请从公开模型目录选择当前可用模型。