> ## Documentation Index
> Fetch the complete documentation index at: https://docs.laozhang.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite API 上线：区别、模型 ID 与接入

> 老张API已接入 Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite。本页说明两款 GA 模型的区别、模型 ID、适用场景、OpenAI 兼容调用方法和常见问题。

* **发布日期**：2026年7月22日
* **最后核对**：2026年7月23日
* **当前状态**：已上线；具体令牌分组和价格以控制台为准

`gemini-3.6-flash` 与 `gemini-3.5-flash-lite` 已接入老张API。通用多模态、代码和多步 Agent 任务优先测试 Gemini 3.6 Flash；分类、抽取、文档解析和成本或延迟敏感的高并发任务优先测试 Gemini 3.5 Flash-Lite。

## 两款新模型有什么区别？

| 模型                    | 官方状态     | 默认 Thinking | 核心定位                   | 推荐任务                       |
| --------------------- | -------- | ----------- | ---------------------- | -------------------------- |
| Gemini 3.6 Flash      | GA，可用于生产 | `medium`    | 速度、智能与 token 效率之间的主力平衡 | 代码、多模态理解、复杂 Agent、知识工作     |
| Gemini 3.5 Flash-Lite | GA，可用于生产 | `minimal`   | 更低延迟和成本的高吞吐轻量模型        | 子 Agent、分类、信息抽取、文档解析、批量自动化 |

Google 官方资料显示，两款模型均提供约 100 万输入 token 上下文和最多 64K 输出 token。老张API实际可用能力、并发和计费仍受令牌分组及当前线路配置影响。

## 正确的模型 ID

* Gemini 3.6 Flash：`gemini-3.6-flash`
* Gemini 3.5 Flash-Lite：`gemini-3.5-flash-lite`

调用时使用完整模型 ID。不要自行添加 `-preview`、`-thinking` 或 `-nothinking` 后缀；只有控制台明确列出的兼容别名才可使用。

## 如何通过老张API调用？

老张API提供 OpenAI 兼容接口。下面的最小请求使用 Gemini 3.6 Flash；切换到轻量模型时只需替换 `model`。

```bash theme={null}
curl https://api.laozhang.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.6-flash",
    "messages": [
      {"role": "user", "content": "比较这两份产品需求并输出风险清单"}
    ]
  }'
```

生产接入前建议：

1. 在[控制台模型与价格页面](https://api.laozhang.ai/account/pricing)确认目标令牌分组已开放该模型；
2. 用目标生产请求做小流量测试，记录响应格式、延迟、token 用量与错误码；
3. 分阶段提高并发，并监控 429、5xx、平均延迟和调用日志中的实际扣费；
4. 从旧模型迁移时保留可回退的模型 ID，不要一次性切换全部生产流量。

## 谁需要关注这次上线？

* 正在为代码、复杂多模态或多步 Agent 工作流选择主力 Flash 模型的团队；
* 需要批量分类、结构化抽取、文档解析或子 Agent 的高吞吐应用；
* 当前使用 Gemini 3.5 Flash、Gemini 3.1 Flash-Lite 或更早 Flash 系列并准备评估迁移的项目。

已有稳定工作流不需要立即迁移。应先用自己的提示词、工具调用和数据格式做对照测试，再决定是否替换生产模型。

## 常见问题

### Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 都是正式版吗？

是。Google 将 `gemini-3.6-flash` 和 `gemini-3.5-flash-lite` 标记为 GA，并说明可用于生产。老张API是否对你的令牌分组开放，仍需在控制台单独确认。

### Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 应该选哪个？

复杂 Agent、代码和多模态任务先测试 Gemini 3.6 Flash；高并发抽取、分类、文档解析和成本敏感任务先测试 Gemini 3.5 Flash-Lite。最终选择应依据真实请求的质量、延迟和总成本，而不是只看模型名称。

### 新模型的 API 地址是什么？

使用老张API OpenAI 兼容接口时，基础地址为 `https://api.laozhang.ai/v1`，文本对话通常调用 `POST /v1/chat/completions`。完整 SDK 配置见[OpenAI 官方库使用指南](/api-capabilities/openai-sdk)。

### 旧版 Gemini 调用代码可以直接迁移吗？

不要直接全量替换。先更换模型 ID 做小流量兼容测试，重点检查工具调用、结构化输出、Thinking 行为、token 用量和延迟。若使用 Google 原生 API，还应阅读 Google 的最新模型迁移说明；原生参数规则不应直接等同于老张API的 OpenAI 兼容协议。

### 如何开启或关闭 Thinking？

Gemini 3 系列通过请求参数控制 Thinking。部分网关兼容别名并非 Google 官方模型 ID；请以控制台当前显示的参数或别名为准，不要自行拼接模型后缀。

### 新模型价格在哪里看？

Google 官方价格与老张API网关价格属于不同计费合同。老张API当前价格、令牌分组和实际扣费以[控制台模型与价格页面](https://api.laozhang.ai/account/pricing)及调用日志为准。

## 资料与相关入口

* [Google：Gemini 3.6 Flash 官方模型页](https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash)
* [Google：Gemini 3.5 Flash-Lite 官方模型页](https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite)
* [Google：最新 Gemini 模型与迁移说明](https://ai.google.dev/gemini-api/docs/latest-model)
* [老张API模型信息与选型指南](/api-capabilities/model-info)
* [老张API OpenAI SDK 接入指南](/api-capabilities/openai-sdk)
* [进入老张API控制台](https://api.laozhang.ai/account/profile)
