gemini-3-pro-image)适合复杂指令、精确文字渲染和专业素材,在老张API可以生成 1K–4K 图片并开启 Google 搜索接地,按次计费。
能力与参数
Nano Banana 2 同样默认启用思考模式、支持搜索接地,还多支持 0.5K 分辨率和 4 种超宽、超高比例。能力依据 Google 图像生成文档,五个模型的对比见 Nano Banana 总览。
Google 已于 2026 年 6 月 25 日停止
gemini-3-pro-image-preview(见 Google 弃用页)。在老张API,-preview ID 会映射到对应的正式 ID,请直接使用正式 ID gemini-3-pro-image。
Google 文档列出的输出像素尺寸如下,imageSize 必须使用大写 K:
价格与能力一览
价格为 2026 年 9 月 24 日公开价格配置,核对日期 2026 年 10 月 10 日;分辨率和参考图数量不改变单价,Google 搜索接地按检索次数另收 $0.014。模型来自 Google 官方渠道,按次线路以固定单价计费,低于 Google 按 token 计费的 1K–4K 单张价格。
调用前准备
在令牌管理创建 API Key,计费模式选择「按量优先」(推荐)或「按次计费」:按量优先的令牌可以同时调用按量和按次计费的模型,按次计费的令牌只能调用按次计费的模型。无图响应与重试的计费说明见计费规则。 设置密钥并安装依赖:nano_banana.py,请把它保存到当前目录。cURL 示例也用它把响应文件保存为图片:
read_image():读取本地图片save_images():从 Gemini 原生响应的parts[].inlineData或 OpenAI 兼容响应的 data URL 中取出 Base64 数据,解码后按 PNG、JPEG 或 WebP 保存
Authorization: Bearer 请求头。Gemini 原生格式也接受 x-goog-api-key 请求头;不要把密钥写进 URL 查询参数(例如 ?key=)。
生成图片
下面生成一张 16:9 的 4K 图片。4K 请求耗时更长,示例把超时设为 300 秒。- cURL
- Python
pro-generate-1.png 等文件,扩展名随返回的图片格式变化。
编辑图片
把本地图片编码为inlineData,和编辑指令放在同一条消息的 parts 中,mimeType 必须与图片的实际格式一致。下面把上一步生成的图片改成雨夜风格(文件名以实际保存的为准):
pro-edit-1.png 等文件。多图合成(最多 14 张参考图)、公网图片 URL 输入、OpenAI 兼容格式的编辑写法和常见错误,见 Nano Banana Pro 图片编辑 API。
用 OpenAI 兼容格式生成
已有 OpenAI SDK 代码时,把base_url 设为 https://api.laozhang.ai/v1,model 改为 gemini-3-pro-image 即可。
这种格式不能设置比例和分辨率,文生图输出 1:1 的 1K 图片。示例关闭了 SDK 的自动重试,避免超时后重复生成和扣费。
- cURL
- Python
content 数组的 image_url,写法见 Nano Banana Pro 图片编辑 API。
搜索接地
开启 Google 搜索接地后,模型会先搜索实时信息再生成图片,适合天气图表、近期事件信息图等依赖最新数据的任务。在请求中加入googleSearch 工具;示例同时请求文字和图片,以便读取模型对搜索结果的说明。
- cURL
- Python
candidates[0].content.parts 中;搜索来源位于 candidates[0].groundingMetadata。
- 同样的请求把模型换成
gemini-3.1-flash-image即可用于 Nano Banana 2;Nano Banana 2 Lite 不支持搜索接地。 - 向最终用户展示接地结果时,需要按 Google 条款展示搜索建议。
- 搜索接地按检索次数另外计费,每次 $0.014;检索次数由模型决定,以调用日志为准,见 Nano Banana 总览的计费规则。
常见问题
要不要从 Pro 换成 Nano Banana 2?
多数任务可以先试 Nano Banana 2(gemini-3.1-flash-image):请求结构相同,切换只改模型 ID,单价更低。
依赖世界知识、多语言文字和精确品牌细节的成片,或编辑时需要风格参考图、最多 5 张人物参考图时,继续用 Pro。切换前用自己的提示词和图片在两个模型上各试几次,逐项差异见 从 Nano Banana Pro 切换。
思考模式能关闭吗?会影响价格吗?
不能关闭。Google 说明 Gemini 3 图像模型默认启用思考,API 中无法关闭;thinkingLevel 只能调整 Nano Banana 2 和 2 Lite 的思考级别,传给 Pro 不会生效。
思考时模型会生成临时图片检验构图,这些图片可能和最终结果一起返回,最后一张是最终结果,处理方法见一次请求能生成多张图吗。
Pro 按次计费,思考多少都不改变单价。
图片里的文字写错或变形怎么办?
Google 建议先让模型生成要放进图片的文字,确认无误后,再要求它生成包含这段文字的图片。提示词里把要出现的文字原样放进引号,并说明位置和字体风格,写法示例见编辑指令怎么写。仍有错字时,把结果图作为输入,只要求修改那一处文字。相关文档
- Nano Banana Pro 图片编辑 API:本地图片与公网 URL 输入、最多 14 张参考图合成
- Nano Banana 总览:五个模型对比、两种调用方式与共用代码
- Nano Banana 2 API:0.5K–4K、14 种比例,单价更低
- Nano Banana 2 Lite API:只需 1K 时的轻量模型
- Gemini 协议:原生请求结构与 SDK 配置
- Google 图像生成文档:比例、像素尺寸、参考图上限、思考模式与文字渲染建议
- Google generateContent 参考:
imageConfig、googleSearch、groundingMetadata等字段定义