Skip to main content
  • 发布日期:2026年7月22日
  • 最后核对:2026年7月23日
  • 当前状态:已上线;具体令牌分组和价格以控制台为准
gemini-3.6-flashgemini-3.5-flash-lite 已接入老张API。通用多模态、代码和多步 Agent 任务优先测试 Gemini 3.6 Flash;分类、抽取、文档解析和成本或延迟敏感的高并发任务优先测试 Gemini 3.5 Flash-Lite。

两款新模型有什么区别?

Google 官方资料显示,两款模型均提供约 100 万输入 token 上下文和最多 64K 输出 token。老张API实际可用能力、并发和计费仍受令牌分组及当前线路配置影响。

正确的模型 ID

  • Gemini 3.6 Flash:gemini-3.6-flash
  • Gemini 3.5 Flash-Lite:gemini-3.5-flash-lite
调用时使用完整模型 ID。不要自行添加 -preview-thinking-nothinking 后缀;只有控制台明确列出的兼容别名才可使用。

如何通过老张API调用?

老张API提供 OpenAI 兼容接口。下面的最小请求使用 Gemini 3.6 Flash;切换到轻量模型时只需替换 model
生产接入前建议:
  1. 控制台模型与价格页面确认目标令牌分组已开放该模型;
  2. 用目标生产请求做小流量测试,记录响应格式、延迟、token 用量与错误码;
  3. 分阶段提高并发,并监控 429、5xx、平均延迟和调用日志中的实际扣费;
  4. 从旧模型迁移时保留可回退的模型 ID,不要一次性切换全部生产流量。

谁需要关注这次上线?

  • 正在为代码、复杂多模态或多步 Agent 工作流选择主力 Flash 模型的团队;
  • 需要批量分类、结构化抽取、文档解析或子 Agent 的高吞吐应用;
  • 当前使用 Gemini 3.5 Flash、Gemini 3.1 Flash-Lite 或更早 Flash 系列并准备评估迁移的项目。
已有稳定工作流不需要立即迁移。应先用自己的提示词、工具调用和数据格式做对照测试,再决定是否替换生产模型。

常见问题

Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 都是正式版吗?

是。Google 将 gemini-3.6-flashgemini-3.5-flash-lite 标记为 GA,并说明可用于生产。老张API是否对你的令牌分组开放,仍需在控制台单独确认。

Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 应该选哪个?

复杂 Agent、代码和多模态任务先测试 Gemini 3.6 Flash;高并发抽取、分类、文档解析和成本敏感任务先测试 Gemini 3.5 Flash-Lite。最终选择应依据真实请求的质量、延迟和总成本,而不是只看模型名称。

新模型的 API 地址是什么?

使用老张API OpenAI 兼容接口时,基础地址为 https://api.laozhang.ai/v1,文本对话通常调用 POST /v1/chat/completions。完整 SDK 配置见OpenAI 官方库使用指南

旧版 Gemini 调用代码可以直接迁移吗?

不要直接全量替换。先更换模型 ID 做小流量兼容测试,重点检查工具调用、结构化输出、Thinking 行为、token 用量和延迟。若使用 Google 原生 API,还应阅读 Google 的最新模型迁移说明;原生参数规则不应直接等同于老张API的 OpenAI 兼容协议。

如何开启或关闭 Thinking?

Gemini 3 系列通过请求参数控制 Thinking。部分网关兼容别名并非 Google 官方模型 ID;请以控制台当前显示的参数或别名为准,不要自行拼接模型后缀。

新模型价格在哪里看?

Google 官方价格与老张API网关价格属于不同计费合同。老张API当前价格、令牌分组和实际扣费以控制台模型与价格页面及调用日志为准。

资料与相关入口