音声生成

OpenAI互換のオーディオAPIでテキストを音声に変換します。

サポートされている音声モデルとボイスを使用して、テキストからストリーミングオーディオを生成します。

POST/openai/v1/audio/speech

リクエストボディ

フィールドタイプ必須説明
model文字列はいテキスト読み上げモデルの識別子。
input文字列はい合成するテキスト。
voice文字列はい選択したプロバイダーによってサポートされるボイス。
response_format文字列いいえmp3のような、要求されたオーディオ形式。

レスポンス

エンドポイントはバイナリオーディオをストリーミングします。レスポンスのコンテンツタイプを使用して、正しいファイル拡張子または再生デコーダーを選択してください。

文字起こし

multipart form data で POST /openai/v1/audio/transcriptions を使用します。filemodel はどちらも必須です。デフォルトの文字起こしモデルに依存せず、公開されているカタログから現在のモデルを選択してください。