Skip to main content
Nano Banana 2.1(gemini-nano-banana-2.1)是 Google 在 2026 年 10 月发布的 Nano Banana 2 更新版,文字渲染、信息图排版和多轮编辑的一致性更好。在老张API按次计费,每次 $0.045,比 Nano Banana 2 便宜。

能力与参数

imageSize 是字符串,使用大写 K,例如 2K。不传 aspectRatio 时由模型按内容决定画幅。 常见输出尺寸:
  • 1:1:1K 为 1024×1024,2K 为 2048×2048,4K 为 4096×4096。
  • 16:9:1K 为 1376×768,2K 为 2752×1536。
  • 其他比例的像素尺寸见 Google 图像生成文档。
五个 Nano Banana 模型的价格与能力对比见 Nano Banana 总览。

和 Nano Banana 2 怎么选

两者的请求结构和响应解析完全相同,切换时只改模型 ID。
  • 新项目和 1K–4K 出图:用 Nano Banana 2.1,单价更低,文字和排版更稳定。
  • 需要 0.5K 预览图:继续用 Nano Banana 2,Nano Banana 2.1 传 512 会返回 400。
  • Nano Banana 2 继续可用,价格不变,已有项目不需要迁移。

调用前准备

在令牌管理创建 API Key,计费模式选择「按量优先」(推荐)或「按次计费」:按量优先的令牌可以同时调用按量和按次计费的模型,按次计费的令牌只能调用按次计费的模型。 设置密钥并安装依赖:
本页示例还需要 Nano Banana 总览中的 nano_banana.py,请把它保存到当前目录。cURL 示例也用它把响应文件保存为图片:
  • read_image():读取本地图片
  • save_images():从 Gemini 原生响应的 parts[].inlineData 或 OpenAI 兼容响应的 data URL 中取出 Base64 数据,解码后按 PNG、JPEG 或 WebP 保存
单次请求通常需要 15–40 秒,4K 更久。示例把超时设为 300 秒,你的客户端和代理也请留足时间。

生成图片

下面生成一张 16:9 的 2K 图片。需要 4K 时把 imageSize 改为 4K;比例从上表中任选。
成功后会得到 nb21-generate-1.jpg 等文件,扩展名随返回的图片格式变化。

编辑图片

把本地图片编码为 inlineData,和编辑指令放在同一条消息的 parts 中。多张参考图按顺序追加,提示词里用「第一张图」「第二张图」指代;最多 14 张。
Python 示例保存为 nb21_edit.py 后,单图编辑可以直接使用上一步生成的图片(文件名以实际保存的为准),多图合成时换成你自己的图片:

搜索接地

在请求中加入 googleSearch 工具,模型会先检索再出图,适合需要最新事实或真实地标外观的图片。下面同时启用网页搜索和图片搜索:
  • searchTypes 必须写成对象。不设置时只启用网页搜索,只写 imageSearch 时只用图片搜索。
  • 每次是否检索、用哪种搜索由模型决定,实际用到的检索词在 groundingMetadata 中。
  • 目前不能把搜索到的真实人物图片用作参考;向最终用户展示接地结果时,需要按 Google 搜索接地说明展示搜索建议。
  • 开启搜索接地的请求,在 $0.045 之外每次检索另收 $0.014。检索 2 次就是 $0.073,调用日志会写明检索次数,见 Nano Banana 总览的计费规则。

OpenAI 兼容格式

已有 OpenAI SDK 代码时,把 base_url 设为 https://api.laozhang.ai/v1,model 改为 gemini-nano-banana-2.1 即可。 这种格式不能设置比例和分辨率,输出 1K 图片,画幅由模型按内容决定,常见为 16:9 横图。需要固定比例或 2K、4K 时,用上面的 Gemini 原生格式。示例关闭了 SDK 的自动重试,避免超时后重复生成和扣费。

生成图片

编辑图片

cURL 示例中的 https://example.com/your-image.jpg 需要替换为你的图片 URL,图片要能被公网直接访问;本地图片请使用 Python 示例,它会把图片转成 data URL。

错误与计费

参数不合法时返回 HTTP 400,不扣费: 计费要点:
  • 每次调用 $0.045,不随分辨率、思考级别、参考图数量或生成 / 编辑而变化。
  • 开启搜索接地时,每次检索另收 $0.014。
  • 上游返回 HTTP 200 即扣费,没有返回图片也一样;原因与避免方法见避免没有图片的扣费。
  • 客户端超时不等于请求失败,重试前先在调用日志确认请求状态。

常见问题

从 Nano Banana 2 切换要改什么?

把模型 ID 从 gemini-3.1-flash-image 改为 gemini-nano-banana-2.1,请求结构和响应解析不变。 切换前检查两处:
  • 请求里用了 "imageSize": "512" 的,改成 1K 或继续用 Nano Banana 2。
  • 没有设置 thinkingLevel 时,Nano Banana 2.1 默认按 medium 思考,Nano Banana 2 默认是 minimal。想要更快出图,显式设为 minimal。

思考级别怎么调?会影响价格吗?

使用 Gemini 原生格式时,在 generationConfig.thinkingConfig.thinkingLevel 中设置级别,可选 minimal、medium、high:
级别越高,构图和文字推敲越充分,耗时也越长。老张API只按次计费,三档都是 $0.045/次(Google 官方则会按思考 tokens 另外计费)。 另外设置 "includeThoughts": true 时,响应会多出带 "thought": true 的思考文字和中间草图,保存时只取最后一张不带 thought 的图片。

4K 和 1K 价格一样吗?

一样,都是 $0.045/次。Google 官方按输出 tokens 计费,4K 每张约 $0.113、1K 约 $0.0336,见 Google 官方价格。只出 1K 小图时,Nano Banana 2 Lite 的单价更低。

OpenAI 兼容格式为什么返回横图?

OpenAI 兼容格式不能传比例,画幅由模型按提示词决定,常见为 16:9。需要方图或竖图时,改用 Gemini 原生格式并设置 aspectRatio。

相关文档