Generar voz

Convierte texto a voz con la API de audio compatible con OpenAI.

Genera audio en streaming a partir de texto utilizando un modelo de voz y una voz compatibles.

POST/openai/v1/audio/speech

Cuerpo de la solicitud

CampoTipoRequeridoDescripción
modelstringIdentificador del modelo de texto a voz.
inputstringTexto a sintetizar.
voicestringVoz compatible con el proveedor seleccionado.
response_formatstringNoFormato de audio solicitado, como mp3.

Respuesta

El endpoint transmite audio binario. Utiliza el tipo de contenido de la respuesta para elegir la extensión de archivo o el decodificador de reproducción correctos.

Transcripción

Utiliza POST /openai/v1/audio/transcriptions con datos de formulario multipart. Tanto file como model son obligatorios. No confíes en un modelo de transcripción predeterminado; elige un modelo actual del catálogo publicado.