gpt-audio-1.5を呼び出します。
主な機能
- 音声入出力 - Chat Completionsの会話の一部として音声を使用
- 音声の選択 - 生成する音声に使用する声を設定
- テキスト文字起こし - 生成された音声とともにテキストを受け取る
- OpenAI互換 - Chat Completionsのリクエスト形式を使用
簡単な使用例
- cURL
- Python
Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
GPT Audio 1.5: 音声の入出力に対応した音声会話モデル。MixRouteでのリクエスト例とパラメーター。
gpt-audio-1.5を呼び出します。
curl "https://api.mixroute.ai/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-audio-1.5",
"modalities": [
"text",
"audio"
],
"audio": {
"voice": "alloy",
"format": "wav"
},
"messages": [
{
"role": "user",
"content": "Give a short spoken welcome to MixRoute."
}
],
"max_completion_tokens": 256
}'
import base64
from pathlib import Path
from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://api.mixroute.ai/v1")
response = client.chat.completions.create(
model="gpt-audio-1.5",
modalities=["text", "audio"],
audio={"voice": "alloy", "format": "wav"},
messages=[{"role": "user", "content": "Give a short spoken welcome to MixRoute."}],
max_completion_tokens=256,
)
audio = response.choices[0].message.audio
Path("reply.wav").write_bytes(base64.b64decode(audio.data))
print(audio.transcript)
| パラメーター | 型 | 必須 | 説明 |
|---|---|---|---|
model | string | はい | gpt-audio-1.5である必要があります。 |
messages | array | はい | 会話メッセージ。contentにはテキストまたはinput_audioパートを含めることができます。 |
modalities | array | はい | 音声の生成をリクエストするにはaudioを含めてください。 |
audio | object | はい | 出力の声と音声形式。 |
max_completion_tokens | integer | いいえ | 生成するトークンの最大数。 |
stream | boolean | いいえ | Chat Completionsのストリーミング出力を有効にします。 |