模型資訊
上下文和輸出長度為模型規格;實際請求限制、可用性與計費取決於 MixRoute 路由。
能力與使用
- 支援文本和影像提示,返回音訊,並可附帶文本;不是語音轉錄或文字轉語音模型。
- 在提示詞中描述曲風、樂器、人聲和期望時長;不使用固定的 seconds 引數。
- 從 candidates[].content.parts[].inlineData.data 讀取 Base64 音訊,並檢查 inlineData.mimeType。預設輸出 MP3,生成音訊為 44.1 kHz 立體聲。
請求示例
呼叫前設定MIXROUTE_API_KEY。
請求欄位
完整請求格式見介面說明。