음성 생성

OpenAI 호환 오디오 API를 사용하여 텍스트를 음성으로 변환합니다.

지원되는 음성 모델과 음성을 사용하여 텍스트에서 스트리밍 오디오를 생성합니다.

POST/openai/v1/audio/speech

요청 본문

필드유형필수설명
modelstring텍스트 음성 변환 모델 식별자입니다.
inputstring합성할 텍스트입니다.
voicestring선택한 제공업체에서 지원하는 음성입니다.
response_formatstring아니요mp3과 같은 요청된 오디오 형식입니다.

응답

엔드포인트는 이진 오디오를 스트리밍합니다. 응답 콘텐츠 유형을 사용하여 올바른 파일 확장명 또는 재생 디코더를 선택하세요.

전사

멀티파트 폼 데이터와 함께 POST /openai/v1/audio/transcriptions을 사용합니다. filemodel은 모두 필수입니다. 기본 전사 모델에 의존하지 마세요. 게시된 카탈로그에서 현재 모델을 선택하세요.