音声生成
OpenAI互換のオーディオAPIでテキストを音声に変換します。
サポートされている音声モデルとボイスを使用して、テキストからストリーミングオーディオを生成します。
POST
/openai/v1/audio/speechリクエストボディ
| フィールド | タイプ | 必須 | 説明 |
|---|---|---|---|
model | 文字列 | はい | テキスト読み上げモデルの識別子。 |
input | 文字列 | はい | 合成するテキスト。 |
voice | 文字列 | はい | 選択したプロバイダーによってサポートされるボイス。 |
response_format | 文字列 | いいえ | mp3のような、要求されたオーディオ形式。 |
レスポンス
エンドポイントはバイナリオーディオをストリーミングします。レスポンスのコンテンツタイプを使用して、正しいファイル拡張子または再生デコーダーを選択してください。
文字起こし
multipart form data で POST /openai/v1/audio/transcriptions を使用します。file と model はどちらも必須です。デフォルトの文字起こしモデルに依存せず、公開されているカタログから現在のモデルを選択してください。