- 发布日期:2026年7月22日
- 最后核对:2026年7月23日
- 当前状态:已上线;具体令牌分组和价格以控制台为准
gemini-3.6-flash 与 gemini-3.5-flash-lite 已接入老张API。通用多模态、代码和多步 Agent 任务优先测试 Gemini 3.6 Flash;分类、抽取、文档解析和成本或延迟敏感的高并发任务优先测试 Gemini 3.5 Flash-Lite。
两款新模型有什么区别?
Google 官方资料显示,两款模型均提供约 100 万输入 token 上下文和最多 64K 输出 token。老张API实际可用能力、并发和计费仍受令牌分组及当前线路配置影响。
正确的模型 ID
- Gemini 3.6 Flash:
gemini-3.6-flash - Gemini 3.5 Flash-Lite:
gemini-3.5-flash-lite
-preview、-thinking 或 -nothinking 后缀;只有控制台明确列出的兼容别名才可使用。
如何通过老张API调用?
老张API提供 OpenAI 兼容接口。下面的最小请求使用 Gemini 3.6 Flash;切换到轻量模型时只需替换model。
- 在控制台模型与价格页面确认目标令牌分组已开放该模型;
- 用目标生产请求做小流量测试,记录响应格式、延迟、token 用量与错误码;
- 分阶段提高并发,并监控 429、5xx、平均延迟和调用日志中的实际扣费;
- 从旧模型迁移时保留可回退的模型 ID,不要一次性切换全部生产流量。
谁需要关注这次上线?
- 正在为代码、复杂多模态或多步 Agent 工作流选择主力 Flash 模型的团队;
- 需要批量分类、结构化抽取、文档解析或子 Agent 的高吞吐应用;
- 当前使用 Gemini 3.5 Flash、Gemini 3.1 Flash-Lite 或更早 Flash 系列并准备评估迁移的项目。
常见问题
Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 都是正式版吗?
是。Google 将gemini-3.6-flash 和 gemini-3.5-flash-lite 标记为 GA,并说明可用于生产。老张API是否对你的令牌分组开放,仍需在控制台单独确认。
Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 应该选哪个?
复杂 Agent、代码和多模态任务先测试 Gemini 3.6 Flash;高并发抽取、分类、文档解析和成本敏感任务先测试 Gemini 3.5 Flash-Lite。最终选择应依据真实请求的质量、延迟和总成本,而不是只看模型名称。新模型的 API 地址是什么?
使用老张API OpenAI 兼容接口时,基础地址为https://api.laozhang.ai/v1,文本对话通常调用 POST /v1/chat/completions。完整 SDK 配置见OpenAI 官方库使用指南。