Skip to main content
Gemini Nano Banana 2.1 面向图片生成与对话式编辑,强化画质、文字渲染、参考一致性和宽幅图片能力。使用 gemini-nano-banana-2.1,不要替换为仅输出文本的 Gemini 型号。

模型信息

以上为模型规格;路由可用性、计费、文件访问权限和请求大小限制取决于所选渠道。图片输出使用下方原生 Gemini 接口。 POST https://api.mixroute.ai/v1/models/gemini-nano-banana-2.1:generateContent POST https://api.mixroute.ai/v1/models/gemini-nano-banana-2.1:streamGenerateContent?alt=sse

生成图片

在本接口使用原生 generationConfig.imageConfig 控制尺寸和比例,不添加 metadata、asset、OpenAI size/n 或请求体 model 字段;模型由 URL 指定。

请求字段

使用限制

  • 比例包括 1:1、1:4、4:1、1:8、8:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9、21:9。
  • 最多 14 张参考图,模型能力说明覆盖最多 4 个角色和 10 个物体;输入上限不代表一致性绝对保证。
  • Vertex 内联图像每张最多 7 MB,支持 PNG、JPEG、WebP、HEIC、HEIF;其他请求限制可能更严格。
  • 不传入不支持的采样或随机性字段 temperature、topP、topK、seed、logprobs。
  • 不支持音频生成、任意函数调用或结构化 JSON 输出。

编辑与多轮调用

将 BASE64_IMAGE_DATA 替换为源图的 Base64 数据。多轮编辑时,将之前完整的 candidate.content 保留为 model 轮次,再追加下一条 user 消息。原样保留所有 thoughtSignature,不要将含图片的历史缩减为纯文本。

读取输出

按类型处理 candidates[].content.parts[]。依据 MIME 类型解码并保存非 thought 的 inlineData 图片,文本部分单独读取。没有图片时检查 promptFeedback 和 finishReason,HTTP 成功不等于一定生成图片。 流式请求使用 streamGenerateContent?alt=sse 和相同请求体,不在 JSON 中添加 stream 开关。解析 SSE data 事件,逐个处理 JSON 中的图片和文本内容块。 图片生成与编辑 | 图片流式输出