模型信息
上下文和输出长度为模型规格;实际请求限制、可用性与计费取决于 MixRoute 路由。
能力与使用
- 支持文本和图像提示,返回音频,并可附带文本;不是语音转录或文字转语音模型。
- 在提示词中描述曲风、乐器、人声和期望时长;不使用固定的 seconds 参数。
- 从 candidates[].content.parts[].inlineData.data 读取 Base64 音频,并检查 inlineData.mimeType。默认输出 MP3,生成音频为 44.1 kHz 立体声。
请求示例
调用前设置MIXROUTE_API_KEY。
请求字段
完整请求格式见接口说明。