> ## Documentation Index
> Fetch the complete documentation index at: https://docs.laozhang.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 当下热门模型

> 2026年7月热门AI模型指南｜覆盖GPT-5.6 Sol/Terra/Luna、Claude Fable 5、Opus 4.8、Sonnet 5、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Grok 4.5、GPT-Image-2、Nano Banana 2/Lite、Seedance 2.0等模型与接入状态

## 2026年7月 AI 热门模型指南

老张API 支持 200+ 主流 AI 模型。本页按文本推理、图像和视频三类整理当前热门选择，重点覆盖 GPT-5.6 Sol / Terra / Luna、Claude Fable 5 / Opus 4.8 / Sonnet 5、Gemini 3.6 Flash / 3.5 Flash-Lite、Grok 4.5、GPT-Image-2、Nano Banana 2 / Lite 与 Seedance 2.0。

<Note>
  **先确认“厂商已发布”与“当前账号可调用”**
  厂商发布状态不等于每个老张API分组都已开放。模型 ID、令牌类型、价格、可用区域和扣费方式请以[控制台实时模型列表](https://api2.laozhang.ai/account/pricing)为准；本页不把产品端名称自动当作 API 模型 ID。
</Note>

## 🔥 2026年7月最新推荐

以下推荐同时参考厂商截至 **2026 年 7 月 22 日**的公开资料与老张API现有接入文档。完整模型和实时价格请访问[控制台定价页面](https://api2.laozhang.ai/account/pricing)。

### ⭐ 文本、推理与 Agent

<CardGroup cols={2}>
  <Card title="GPT-5.6 Sol / Terra / Luna" icon="bot" color="#10a37f">
    OpenAI 最新 API 家族：Sol 旗舰、Terra 均衡、Luna 面向高吞吐低成本
  </Card>

  <Card title="Claude Fable 5 / Opus 4.8" icon="brain" color="#cc785c">
    Fable 5 是最新高能力级别；Opus 4.8 适合高难度编程、Agent 与专业工作
  </Card>

  <Card title="Claude Sonnet 5" icon="lightbulb" color="#0084ff">
    已接入老张API，适合编程 Agent、工具调用、长任务与规模化生产
  </Card>

  <Card title="Gemini 3.6 / 3.5 Flash · Grok 4.5" icon="sparkles" color="#4285f4">
    Gemini 覆盖稳定 Flash 与低成本高并发；Grok 4.5 是 xAI 最新 500K 旗舰
  </Card>
</CardGroup>

### 🎨 图像与视频生成

<CardGroup cols={2}>
  <Card title="GPT-Image-2" icon="image" href="/api-capabilities/gpt-image-2">
    OpenAI 最新图像路线，支持文生图、图改图与多档尺寸/质量线路
  </Card>

  <Card title="Nano Banana 2 / Lite" icon="image" href="/api-capabilities/nano-banana2-image">
    `gemini-3.1-flash-image` 覆盖 0.5K–4K；Lite 面向 1K 低成本高并发
  </Card>

  <Card title="Seedance 2.0" icon="video" href="/api-capabilities/seedance2-video-generation">
    标准版与 Fast 版，支持文本、图片、视频、音频等多模态参考生成
  </Card>

  <Card title="Wan 2.7 / Veo 3.1" icon="video">
    覆盖通用异步视频生成、参考生成、编辑和高质量成片
  </Card>
</CardGroup>

## AI模型详细列表（按厂商分类）

<Note>
  **状态说明**：标为“已接入”的模型可在本仓库公告或专题文档中确认；仅有厂商发布信息的模型仍须在控制台确认当前分组是否开放。历史模型保留用于迁移，不作为新项目首选。

  表格中的“上下文长度”优先采用厂商原生 API 上限；老张API或其他网关可能因线路、区域和套餐设置更低上限。
</Note>

### 🤖 OpenAI 系列

#### GPT-5.6 系列（最新）🔥

| 模型名称                 | 模型ID                      | 上下文长度 | 特点                      | 推荐场景                    |
| -------------------- | ------------------------- | ----- | ----------------------- | ----------------------- |
| **GPT-5.6 Sol** ⭐⭐⭐  | `gpt-5.6` / `gpt-5.6-sol` | 1.05M | 当前旗舰；`gpt-5.6` 默认指向 Sol | 高难度编程、Agent、专业工作与复杂多步任务 |
| **GPT-5.6 Terra** ⭐⭐ | `gpt-5.6-terra`           | 1.05M | 智能、速度和成本更均衡             | 生产级 Agent、代码与通用知识工作     |
| **GPT-5.6 Luna** ⭐   | `gpt-5.6-luna`            | 1.05M | 面向成本敏感和高吞吐任务            | 批处理、分类、抽取与规模化自动化        |

<Tip>
  **GPT-5.6 模型说明**：`gpt-5.6` 是 `gpt-5.6-sol` 的便捷别名。GPT-5.6 的 Pro 是请求参数 `reasoning.mode: "pro"`，不是 `gpt-5.6-pro` 模型 ID。老张API是否已开放各档位及是否透传 Pro 模式，请以控制台为准。
</Tip>

#### GPT-5.5 系列（上一代兼容）

| 模型名称            | 模型ID          | 上下文长度 | 特点         | 推荐场景     |
| --------------- | ------------- | ----- | ---------- | -------- |
| **GPT-5.5**     | `gpt-5.5`     | 1.05M | 上一代综合旗舰    | 现有项目兼容   |
| **GPT-5.5 Pro** | `gpt-5.5-pro` | 1.05M | 上一代高计算推理版本 | 已有高难度工作流 |

#### GPT-5.1 系列（2025年11月）🔥

| 模型名称                   | 模型ID                 | 上下文长度 | 特点                   | 推荐场景         |
| ---------------------- | -------------------- | ----- | -------------------- | ------------ |
| **GPT-5.1** ⭐⭐         | `gpt-5.1`            | 400K  | 强大综合能力，平衡成本和能力       | 通用高级任务       |
| **GPT-5.1-Codex** ⭐⭐   | `gpt-5.1-codex`      | 400K  | Responses API 编程专用模型 | 编程开发、长周期代码任务 |
| **GPT-5.1-Codex Mini** | `gpt-5.1-codex-mini` | 400K  | 轻量编程模型               | 快速编程、代码补全    |

<Tip>
  **GPT-5.1-Codex 系列说明**：官方模型 ID 是 `gpt-5.1-codex` 与 `gpt-5.1-codex-mini`。High、Medium 等属于请求中的推理强度配置，不应拼接为 `gpt-5.1-codex-high` 或 `gpt-5.1-codex-medium`。
</Tip>

#### GPT-5 系列（2025年8月）

| 模型名称           | 模型ID         | 上下文长度 | 特点              | 推荐场景    |
| -------------- | ------------ | ----- | --------------- | ------- |
| **GPT-5** ⭐    | `gpt-5`      | 400K  | 第一代 GPT-5，综合能力强 | 通用任务    |
| **GPT-5 Pro**  | `gpt-5-pro`  | 400K  | 高计算推理版本         | 企业级复杂任务 |
| **GPT-5 Mini** | `gpt-5-mini` | 400K  | 轻量高效版本          | 成本敏感场景  |
| **GPT-5 Nano** | `gpt-5-nano` | 400K  | 超轻量版本           | 大批量处理   |

#### 推理模型（Reasoning Models）

| 模型名称           | 模型ID      | 上下文长度 | 特点           | 推荐场景       |
| -------------- | --------- | ----- | ------------ | ---------- |
| **o3-pro** ⭐⭐  | `o3-pro`  | 200K  | 最强推理能力，顶级性能  | 顶级推理任务     |
| **o3** ⭐       | `o3`      | 200K  | 推理模型，适合复杂任务  | 复杂推理、数学、编程 |
| **o4-mini** ⭐⭐ | `o4-mini` | 200K  | 轻量级推理，编程成本较低 | 编程任务首选     |
| **o3-mini**    | `o3-mini` | 200K  | 轻量级推理模型      | 快速推理       |

<Note>
  **上一代推理模型 (o1 系列)**：o1、o1-pro、o1-preview、o1-mini 等模型已被 o3/o4 系列取代，建议优先使用 o3-pro 或 o4-mini。
</Note>

#### GPT-4.1 系列（2025年4月）

| 模型名称             | 模型ID           | 上下文长度 | 特点         | 推荐场景       |
| ---------------- | -------------- | ----- | ---------- | ---------- |
| **GPT-4.1** ⭐    | `gpt-4.1`      | 1.05M | 非推理长上下文模型  | 综合应用、长文档处理 |
| **GPT-4.1 Mini** | `gpt-4.1-mini` | 1.05M | 更经济的轻量版本   | 成本敏感场景     |
| **GPT-4.1 Nano** | `gpt-4.1-nano` | 1.05M | 超轻量版本，极低成本 | 大批量处理      |

#### GPT-4o 系列（经典稳定）

| 模型名称                  | 模型ID                | 上下文长度 | 特点                   | 推荐场景   |
| --------------------- | ------------------- | ----- | -------------------- | ------ |
| **GPT-4o** ⭐          | `gpt-4o`            | 128K  | 综合能力平衡，多模态支持         | 通用场景   |
| **ChatGPT-4o Latest** | `chatgpt-4o-latest` | 128K  | 同步 ChatGPT Plus 官网模型 | 需要最新特性 |
| **GPT-4o Mini**       | `gpt-4o-mini`       | 128K  | 轻量快速版本               | 快速响应   |

<Note>
  **经济型选择**：对于成本敏感场景，建议优先考虑 GPT-5 Nano、GPT-4.1 Nano 或 GPT-4o Mini。
</Note>

#### 图像生成模型

##### OpenAI 图像生成系列

| 模型名称                 | 模型ID                              | 支持尺寸                                                        | 特点                     | 价格                                    |
| -------------------- | --------------------------------- | ----------------------------------------------------------- | ---------------------- | ------------------------------------- |
| **GPT-Image-2** ⭐⭐⭐  | `gpt-image-2` / `gpt-image-2-vip` | 官方任意 16 倍数宽高，最长边 3840px、最多 8,294,400 像素；VIP 常用 1K / 2K / 4K | 当前推荐；支持生成与编辑，线路由令牌分组决定 | [查看文档](/api-capabilities/gpt-image-2) |
| **GPT-Image-1.5** ⭐⭐ | `gpt-image-1.5`                   | 1024×1024等                                                  | 上一代高质量图像模型             | 详见下方文档                                |
| **GPT-Image-1** ⭐    | `gpt-image-1`                     | 1024×1024等                                                  | 按量接入图像生成               | 详见下方文档                                |
| **GPT-Image-1 Mini** | `gpt-image-1-mini`                | 1024×1024等                                                  | 轻量快速版本                 | 详见下方文档                                |
| **Sora Image**       | `sora_image`                      | 多种尺寸                                                        | 旧接入模型，模拟官网对话出图         | 详见文档                                  |
| **GPT-4o Image**     | `gpt-4o-image`                    | 多种尺寸                                                        | 旧接入模型，对话式生图            | 详见文档                                  |
| **DALL·E 3**         | `dall-e-3`                        | 1024×1024等                                                  | 经典图像生成模型               | 按尺寸计费                                 |

##### Flux 系列（高质量图像生成）🔥

| 模型名称                    | 模型ID               | 特点       | 推荐场景       |
| ----------------------- | ------------------ | -------- | ---------- |
| **Flux Kontext Max** ⭐⭐ | `flux-kontext-max` | 最高质量图像生成 | 专业设计、高要求场景 |
| **Flux Kontext Pro** ⭐  | `flux-kontext-pro` | 专业级图像生成  | 商业设计、营销素材  |

<Tip>
  **图像生成测试工具**
  访问 [yingtu.ai](https://yingtu.ai) 体验各种图像生成模型的效果。

  详细文档：

  * [GPT-Image-2 API](/api-capabilities/gpt-image-2)
  * [图像生成 API 选型指南](/api-capabilities/image-generation-guide)
  * [GPT-Image-1 文档](https://xinqikeji.feishu.cn/docx/TxIbdmYWboXWHXxzxMCcnqJ0nyd)
</Tip>

#### 视频生成模型 🎬

##### Sora 2 官方 API 转发（当前可用）

<Warning>
  本仓库较新的专题文档确认，当前可用的是按量计费的 Sora 2 官方 API 转发。2026 年 7 月 1 日停止的是旧官网模拟/旧转发线路，不能据此把现在的 `sora-2` 与 `sora-2-pro` 判定为退役。
</Warning>

| 模型名称              | 模型ID         | 特点               | 推荐场景        |
| ----------------- | ------------ | ---------------- | ----------- |
| **Sora 2** ⭐      | `sora-2`     | 当前官方 API 转发标准模型  | 通用视频生成      |
| **Sora 2 Pro** ⭐⭐ | `sora-2-pro` | 当前官方 API 转发高质量模型 | 专业成片、更高质量任务 |

<Tip>
  Sora 2 当前线路仅支持 `Sora2Official` 或 `GPTImage2 Enterprise` 分组的按量令牌。`sora_video2*`、`sora2_video`、`sora-2-character` 等旧官网模拟/角色别名仅用于历史项目排查。详见 [Sora 2 官方 API 转发](/api-capabilities/sora2/official-forward)。
</Tip>

##### Seedance 2.0 系列（已接入）🔥

| 模型名称                     | 模型ID                              | 特点                        | 推荐场景           |
| ------------------------ | --------------------------------- | ------------------------- | -------------- |
| **Seedance 2.0 Fast** ⭐⭐ | `doubao-seedance-2-0-fast-260128` | 快速多模态视频生成；支持文本、图片、视频、音频参考 | 快速迭代、参考生成、视频延长 |
| **Seedance 2.0** ⭐⭐      | `doubao-seedance-2-0-260128`      | 标准质量；支持首尾帧、视频编辑和复杂参考      | 稳定成片、视频编辑、精细控制 |

<Tip>
  Seedance 2.0 使用 `SeeDance2` 分组、按量扣费令牌与异步任务接口 `/seedance/api/v3/contents/generations/tasks`。完整参数、计费和轮询方式请查看 [Seedance 2.0 视频生成 API](/api-capabilities/seedance2-video-generation)。
</Tip>

##### Wan 2.7 系列（DashScope 透传）

| 模型名称                           | 模型ID               | 特点                    | 推荐场景           |
| ------------------------------ | ------------------ | --------------------- | -------------- |
| **Wan 2.7 Text-to-Video** ⭐    | `wan2.7-t2v`       | 文生视频，DashScope 兼容异步任务 | 提示词生成视频、通用短片   |
| **Wan 2.7 Image-to-Video** ⭐   | `wan2.7-i2v`       | 图生视频，可配首帧和驱动音频        | 图片动态化、音频驱动人物   |
| **Wan 2.7 Reference-to-Video** | `wan2.7-r2v`       | 参考图生视频                | 服装、风格或主体参考生成   |
| **Wan 2.7 Video Edit**         | `wan2.7-videoedit` | 输入视频 + 参考图编辑          | 换装、局部编辑、视频素材改造 |

<Tip>
  Wan 2.7 使用 `Wan` 分组、按量扣费令牌和 DashScope 兼容异步接口，创建任务路径为 `/wan/api/v1/services/aigc/video-generation/video-synthesis`。接入参数请查看 [Wan 2.7 视频生成 API](/api-capabilities/wan-video-generation)。
</Tip>

##### Google Veo 3.1 系列（当前接入）🔥

| 模型名称                                | 模型ID                            | 特点        | 推荐场景      |
| ----------------------------------- | ------------------------------- | --------- | --------- |
| **Veo 3.1 Generate Preview** ⭐⭐     | `veo-3.1-generate-preview`      | 当前高质量预览路线 | 标准与专业视频生成 |
| **Veo 3.1 Fast Generate Preview** ⭐ | `veo-3.1-fast-generate-preview` | 当前快速预览路线  | 快速原型与批量生成 |

<Note>
  **视频生成说明**
  不同视频线路可能采用按次、按量或异步任务结算，具体价格请访问[控制台定价页面](https://api2.laozhang.ai/account/pricing)。`veo-3.1`、`veo-3.1-fast`、`veo-3.1-fl`、`veo3*` 等旧 ID 已有不可用记录，新项目不要照抄旧 ID；先查看 [Veo 3.1 官方 API 转发](/api-capabilities/veo/official-forward)，确认令牌分组并做小规模测试。
</Note>

### 🎭 Claude 系列 (Anthropic)

<Tip>
  **推理模式说明**：Claude 新模型通过官方 `effort` / thinking 参数控制推理强度。`-thinking` 后缀不是 Anthropic 官方模型 ID，因此不再把自行拼接的后缀写入主表；只有控制台明确列出时才能作为网关兼容别名使用。
</Tip>

#### Claude 5 / 4.8 最新系列 🔥

| 模型名称                    | 模型ID              | 上下文长度 | 特点                               | 推荐场景                 |
| ----------------------- | ----------------- | ----- | -------------------------------- | -------------------- |
| **Claude Fable 5** ⭐⭐⭐  | `claude-fable-5`  | 1M    | Anthropic 最新高能力级别；官方已恢复全球 API 访问 | 超复杂 Agent、研究与高难度专业任务 |
| **Claude Opus 4.8** ⭐⭐  | `claude-opus-4-8` | 1M    | 最新 Opus，强调判断力、长任务一致性和工具效率        | 高难度编程、浏览器 Agent、专业工作 |
| **Claude Sonnet 5** ⭐⭐⭐ | `claude-sonnet-5` | 1M    | 已接入老张API；性能接近 Opus 4.8，速度与成本更平衡  | 编程 Agent、工具调用、规模化生产  |

<Tip>
  **老张API已确认接入**：`claude-sonnet-5` 已在 2026 年 7 月公告上线。`claude-fable-5` 与 `claude-opus-4-8` 请先在控制台确认当前账号和分组是否开放，再用于生产。
</Tip>

#### Claude 4.7 / 4.6 / Haiku 系列（兼容与成本选择）

| 模型名称                     | 模型ID                | 上下文长度 | 特点      | 推荐场景                |
| ------------------------ | ------------------- | ----- | ------- | ------------------- |
| **Claude Opus 4.7** ⭐    | `claude-opus-4-7`   | 1M    | 成熟高能力版本 | 复杂推理、编程 Agent、长流程任务 |
| **Claude Sonnet 4.6** ⭐⭐ | `claude-sonnet-4-6` | 1M    | 速度与智能平衡 | 代码生成、复杂分析、长文本       |
| **Claude Haiku 4.5**     | `claude-haiku-4-5`  | 200K  | 轻量快速版本  | 快速响应场景              |

#### Claude 4.5 系列（经典高性能）

| 模型名称                  | 模型ID                | 上下文长度 | 特点      | 推荐场景       |
| --------------------- | ------------------- | ----- | ------- | ---------- |
| **Claude Opus 4.5**   | `claude-opus-4-5`   | 200K  | 经典高性能版本 | 高质量分析、代码任务 |
| **Claude Sonnet 4.5** | `claude-sonnet-4-5` | 200K  | 稳定编程版本  | 日常开发、代码生成  |

#### Claude 4 系列（2025年5月）

| 模型名称                  | 模型ID              | 上下文长度 | 特点   | 推荐场景    |
| --------------------- | ----------------- | ----- | ---- | ------- |
| **Claude 4 Sonnet** ⭐ | `claude-sonnet-4` | 200K  | 稳定版本 | 代码生成、分析 |
| **Claude 4.1 Opus**   | `claude-opus-4-1` | 200K  | 增强版本 | 高要求任务   |

#### Claude 3.7 系列（2025年2月）

| 模型名称                  | 模型ID                       | 上下文长度 | 特点   | 推荐场景 |
| --------------------- | -------------------------- | ----- | ---- | ---- |
| **Claude 3.7 Sonnet** | `claude-3-7-sonnet-latest` | 200K  | 旧版兼容 | 通用场景 |

#### Claude 3.5 系列（经典）

| 模型名称                  | 模型ID                       | 上下文长度 | 特点     | 推荐场景   |
| --------------------- | -------------------------- | ----- | ------ | ------ |
| **Claude 3.5 Sonnet** | `claude-3-5-sonnet-latest` | 200K  | 经典稳定版本 | 通用场景   |
| **Claude 3.5 Haiku**  | `claude-3-5-haiku-latest`  | 200K  | 快速轻量版  | 日常快速任务 |

#### Claude 3 系列（已弃用）

<Warning>
  **弃用提醒**

  * **Claude 3 Opus** (`claude-3-opus-20240229`) 已于 **2026年1月5日** 退役
  * **Claude 3 Sonnet** (`claude-3-sonnet-20240229`) 已于 **2025年7月21日** 退役
  * **Claude 3 Haiku** (`claude-3-haiku-20240307`) 建议迁移到 Claude Haiku 4.5

  新项目优先评估 Claude Sonnet 5 或 Opus 4.8；需要成熟兼容线路时可继续使用 Opus 4.7、Sonnet 4.6 或 Haiku 4.5。
</Warning>

| 模型名称                | 模型ID                       | 上下文长度 | 状态     |
| ------------------- | -------------------------- | ----- | ------ |
| **Claude 3 Opus**   | `claude-3-opus-20240229`   | 200K  | ❌ 已退役  |
| **Claude 3 Sonnet** | `claude-3-sonnet-20240229` | 200K  | ❌ 已退役  |
| **Claude 3 Haiku**  | `claude-3-haiku-20240307`  | 200K  | ⚠️ 不推荐 |

### 🌟 Google Gemini 系列

<Tip>
  **Thinking 模式说明**：Gemini 3 / 2.5 系列通过请求参数控制 Thinking。部分网关可能提供 `-thinking` 或 `-nothinking` 兼容别名，但这些不是 Google 官方模型 ID，请仅使用控制台实际列出的别名。
</Tip>

#### Gemini 3.6 / 3.5 系列（最新）🔥

| 模型名称                                    | 模型ID                                 | 上下文长度 | 特点                                            | 推荐场景                 |
| --------------------------------------- | ------------------------------------ | ----- | --------------------------------------------- | -------------------- |
| **Gemini 3.6 Flash** ⭐⭐⭐                | `gemini-3.6-flash`                   | 1.05M | 最新稳定 Flash；提升 token 效率、代码与 Agent 规划能力，并减少冗长输出 | 快速多模态、代码、Agent、知识工作  |
| **Gemini 3.5 Flash-Lite** ⭐⭐            | `gemini-3.5-flash-lite`              | 1.05M | 最新稳定轻量档，低延迟、低成本                               | 子 Agent、高并发自动化、分类与抽取 |
| **Gemini 3.5 Flash** ⭐⭐                 | `gemini-3.5-flash`                   | 1.05M | 上一代稳定 Flash 主力                                | 现有多模态、代码与 Agent 工作流  |
| **Gemini 3.1 Pro Preview** ⭐⭐           | `gemini-3.1-pro-preview`             | 1.05M | 最新 Pro 预览模型，工具和多步任务能力强                        | 高级任务、长文本、编程 Agent    |
| **Gemini 3.1 Pro Preview Custom Tools** | `gemini-3.1-pro-preview-customtools` | 1.05M | 面向自定义工具和 bash 工作流                             | Agent 工具调用           |
| **Gemini 3.1 Flash-Lite**               | `gemini-3.1-flash-lite`              | 1.05M | 较早的稳定轻量模型                                     | 现有低成本工作流兼容           |

<Note>
  **Gemini 选型说明**：新项目的通用 Flash 路线优先评估 `gemini-3.6-flash`，成本和延迟敏感的高并发任务优先评估 `gemini-3.5-flash-lite`。`gemini-3.5-flash` 与 `gemini-3.1-flash-lite` 保留用于现有项目兼容；生产调用仍以控制台实际开放的稳定模型 ID 为准。
</Note>

#### Gemini 2.5 系列（2025）

| 模型名称                      | 模型ID                    | 上下文长度 | 特点             | 推荐场景   |
| ------------------------- | ----------------------- | ----- | -------------- | ------ |
| **Gemini 2.5 Pro** ⭐      | `gemini-2.5-pro`        | 1.05M | 正式版，编程与复杂推理能力强 | 生产环境   |
| **Gemini 2.5 Flash** ⭐    | `gemini-2.5-flash`      | 1.05M | 正式版，速度与成本平衡    | 日常快速响应 |
| **Gemini 2.5 Flash-Lite** | `gemini-2.5-flash-lite` | 1.05M | 轻量低成本版本        | 超高并发场景 |

#### Gemini 最新图像生成模型（Nano Banana 系列）🔥

| 模型名称                                                    | 模型ID                          | 特点                        | 推荐场景         |
| ------------------------------------------------------- | ----------------------------- | ------------------------- | ------------ |
| **Gemini 3.1 Flash Image / Nano Banana 2** ⭐⭐⭐          | `gemini-3.1-flash-image`      | 0.5K–4K、通用质量/速度平衡、支持生成和编辑 | 高吞吐生产图、复杂编辑  |
| **Gemini 3.1 Flash Lite Image / Nano Banana 2 Lite** ⭐⭐ | `gemini-3.1-flash-lite-image` | 固定 1K、支持 14 种宽高比、低延迟低成本   | 草稿、批量素材、高并发  |
| **Gemini 3 Pro Image / Nano Banana Pro** ⭐⭐⭐            | `gemini-3-pro-image`          | 专业 4K、复杂指令、文字与布局能力强       | 专业资产、海报、复杂编辑 |
| **Gemini 2.5 Flash Image / Nano Banana**                | `gemini-2.5-flash-image`      | 1K 稳定兼容路线                 | 旧项目兼容、低成本生成  |

<Tip>
  图像新项目：综合质量与成本优先 `gemini-3.1-flash-image`；1K 高频任务选 `gemini-3.1-flash-lite-image`；专业复杂成片选 `gemini-3-pro-image`。详见 [Nano Banana 2](/api-capabilities/nano-banana2-image)、[Nano Banana 2 Lite](/api-capabilities/nano-banana-2-lite-api)和 [Nano Banana Pro](/api-capabilities/nano-banana-pro-image)。
</Tip>

#### Gemini 2.0 系列（已停止服务）

`gemini-2.0-flash-001` 与 `gemini-2.0-flash-lite-001` 已于 2026 年 6 月停止服务。新项目不要再使用这些模型 ID。

#### Gemini 1.5 系列（历史兼容）

Gemini 1.5 系列不再作为新项目推荐模型。新接入建议优先选择 `gemini-3.6-flash`、`gemini-3.5-flash-lite`、`gemini-3.1-pro-preview` 或稳定的 `gemini-2.5-pro`。

### 🚀 xAI Grok 系列

| 模型名称                        | 模型ID                           | 特点                             | 推荐场景             |
| --------------------------- | ------------------------------ | ------------------------------ | ---------------- |
| **Grok 4.5** ⭐⭐⭐            | `grok-4.5`                     | 2026 年 7 月最新旗舰，500K 上下文，可调推理强度 | 编程、Agent、工程与知识工作 |
| **Grok 4.3** ⭐⭐             | `grok-4.3`                     | 1M 上下文，主力通用模型                  | 长上下文、通用对话与工具任务   |
| **Grok 4.20 Reasoning**     | `grok-4.20-0309-reasoning`     | 1M 上下文固定快照                     | 推理任务、版本固定的生产调用   |
| **Grok 4.20 Non-Reasoning** | `grok-4.20-0309-non-reasoning` | 非推理快照，响应更直接                    | 快速生成与结构化任务       |
| **Grok 4.20 Multi-Agent**   | `grok-4.20-multi-agent-0309`   | 多 Agent 专用快照                   | 并行研究与多角色工作流      |

<Warning>
  `grok-4-0709`、`grok-4-fast-*`、`grok-3` 等旧 ID 已在 xAI 官方退役并重定向到 Grok 4.3。新项目直接使用 `grok-4.5` 或控制台当前提供的 Grok 4.3 / 4.20 模型。
</Warning>

#### Grok Imagine 图像与视频

| 模型名称                             | 模型ID                         | 特点                      | 推荐场景          |
| -------------------------------- | ---------------------------- | ----------------------- | ------------- |
| **Grok Imagine Image Quality** ⭐ | `grok-imagine-image-quality` | 高质量图像生成与编辑路线            | 成片、营销素材、精细编辑  |
| **Grok Imagine Image**           | `grok-imagine-image`         | 标准图像生成路线                | 快速生成与日常素材     |
| **Grok Imagine Video 1.5** ⭐     | `grok-imagine-video-1.5`     | xAI 当前新一代视频模型，暂不支持纯文生视频 | 图生视频、参考与编辑工作流 |
| **Grok Imagine Video**           | `grok-imagine-video`         | 支持文生视频的兼容路线             | 文生视频与已有视频工作流  |

<Note>
  以上是 xAI 官方模型 ID；老张API是否已接入对应图像或视频分组，仍须在控制台确认。
</Note>

### 🔍 DeepSeek 系列

| 模型名称                     | 模型ID                | 上下文长度 | 特点                        | 推荐场景               |
| ------------------------ | ------------------- | ----- | ------------------------- | ------------------ |
| **DeepSeek V4 Pro** ⭐⭐⭐  | `deepseek-v4-pro`   | 1M    | 最新高能力版本，支持 Thinking 与工具调用 | 复杂推理、编程 Agent、长上下文 |
| **DeepSeek V4 Flash** ⭐⭐ | `deepseek-v4-flash` | 1M    | 更快、更经济的 V4 路线             | 日常开发、高并发、通用任务      |
| **DeepSeek V3.2**        | 以控制台为准              | 128K  | 上一代稳定混合推理模型               | 已有 V3.2 工作负载       |
| **DeepSeek R1 (05-28)**  | `deepseek-r1-0528`  | 128K  | 历史独立推理模型                  | 已有数学与推理任务          |

<Warning>
  DeepSeek 官方将在 2026 年 7 月 24 日停止 `deepseek-chat` 与 `deepseek-reasoner` 旧别名。新项目应改用 `deepseek-v4-pro` 或 `deepseek-v4-flash`；老张API是否同步开放请查看控制台。
</Warning>

### 🐘 国产模型系列

#### 阿里通义千问 Qwen 3.8 / 3.7 系列（最新）🔥

| 模型名称                         | 模型ID                  | 上下文长度    | 特点                             | 推荐场景                  |
| ---------------------------- | --------------------- | -------- | ------------------------------ | --------------------- |
| **Qwen 3.8 Max Preview** ⭐⭐⭐ | `qwen3.8-max-preview` | 以官方计划页为准 | 当前最高代际预览，仅 Token Plan 开放       | 前沿能力测试；生产前先确认计划与控制台权限 |
| **Qwen 3.7 Max** ⭐⭐⭐         | `qwen3.7-max`         | 1M       | 最新旗舰，支持 Thinking、工具、内置搜索和结构化输出 | 复杂推理、编程、长周期 Agent     |
| **Qwen 3.7 Plus** ⭐⭐         | `qwen3.7-plus`        | 1M       | 原生视觉语言与交互式 Agent 能力            | 多模态 Agent、生产工作流       |
| **Qwen 3.6 Flash** ⭐         | `qwen3.6-flash`       | 1M       | 高性价比快速模型                       | 高并发、轻量 Agent、视觉理解     |

<Note>
  `qwq-*`、`qwen-max`、`qwen-plus` 和 `qwen-turbo` 仍可能用于旧项目，但已不代表千问当前最新代际。老张API可调用 ID 仍以控制台为准。
</Note>

#### 阿里通义千问 Coder 3 系列（编程专用）🔥

| 模型名称                    | 模型ID                             | 参数规模          | 特点            | 推荐场景   |
| ----------------------- | -------------------------------- | ------------- | ------------- | ------ |
| **Qwen3 Coder 480B** ⭐⭐ | `qwen3-coder-480b-a35b-instruct` | 480B (35B 激活) | 超大编程模型，MoE 架构 | 复杂编程任务 |
| **Qwen3 Coder Plus** ⭐  | `qwen3-coder-plus`               | -             | 增强编程版         | 标准编程任务 |

<Tip>
  **Qwen3 Coder 480B 特性**：采用 MoE（Mixture of Experts）架构，总参数 480B，每次激活 35B 参数，在代码生成、代码理解、调试等任务上性能卓越。
</Tip>

#### 阿里通义千问旧别名（兼容）

| 模型名称           | 模型ID         | 上下文长度  | 特点     |
| -------------- | ------------ | ------ | ------ |
| **Qwen Max**   | `qwen-max`   | 以控制台为准 | 历史通用别名 |
| **Qwen Plus**  | `qwen-plus`  | 以控制台为准 | 历史均衡别名 |
| **Qwen Turbo** | `qwen-turbo` | 以控制台为准 | 历史快速别名 |

#### Moonshot Kimi 系列

| 模型名称                         | 模型ID                       | 上下文长度 | 特点                                        |
| ---------------------------- | -------------------------- | ----- | ----------------------------------------- |
| **Kimi K3** ⭐⭐⭐              | `kimi-k3`                  | 1.05M | 2026 年 7 月最新旗舰，始终启用 Thinking，支持视觉理解与长周期编程 |
| **Kimi K2.7 Code** ⭐⭐        | `kimi-k2.7-code`           | 256K  | 长周期软件工程专用 Thinking 模型                     |
| **Kimi K2.7 Code Highspeed** | `kimi-k2.7-code-highspeed` | 256K  | K2.7 Code 高速版本                            |

<Warning>
  Moonshot 官方 ID 不带 `kimi/` 渠道前缀；若某个网关要求该前缀，应以其控制台为准。Kimi K2 系列已公告停止服务，不再作为新项目兼容推荐。
</Warning>

#### Meta Llama 4 系列🔥

| 模型名称                 | 模型ID               | 特点     | 推荐场景      |
| -------------------- | ------------------ | ------ | --------- |
| **Llama 4 Maverick** | `llama-4-maverick` | 成熟开源模型 | 已有开源应用、研究 |

<Note>
  **Llama 4 Maverick**：保留用于已有开源模型工作流；如需新版本，请先确认控制台当前开放的 Llama 模型 ID。
</Note>

#### 字节即梦 Seedream 系列（图像生成）

| 模型名称                | 模型ID                  | 发布日期       | 特点               | 推荐场景   |
| ------------------- | --------------------- | ---------- | ---------------- | ------ |
| **Seedream 4.5** ⭐⭐ | `seedream-4-5-251128` | 2025-11-28 | 老张API当前文档中的高质量版本 | 专业图像生成 |
| **Seedream 4.0**    | `seedream-4-0-250828` | 2025-08-28 | 稳定兼容版            | 通用图像生成 |

<Tip>
  厂商已发布更新的 Seedream 版本，但老张API调用请使用控制台实际开放的 ID；不要把厂商产品名直接写入请求。现有接入方式请查看 [Seedream 图像生成 API](/api-capabilities/seedream-image)。
</Tip>

#### 字节豆包 Doubao 系列🔥

| 模型名称                        | 模型ID                        | 上下文 | 特点          | 推荐场景       |
| --------------------------- | --------------------------- | --- | ----------- | ---------- |
| **Doubao 1.5 Vision Pro** ⭐ | `Doubao-1.5-vision-pro-32k` | 32K | 多模态模型，视觉能力强 | 图文理解、多模态任务 |

<Note>
  **字节豆包**：字节跳动推出的多模态大模型，在图文理解、视觉问答等任务上表现优异。
</Note>

#### Google Gemma 3 系列（开源）

| 模型名称            | 模型ID          | 参数  | 特点           | 推荐场景    |
| --------------- | ------------- | --- | ------------ | ------- |
| **Gemma 3 12B** | `gemma-3-12b` | 12B | Google 开源小模型 | 轻量部署、研究 |

#### 其他国产模型

| 模型名称             | 模型ID         | 特点                                          |
| ---------------- | ------------ | ------------------------------------------- |
| **GLM-5.2** ⭐⭐   | `glm-5.2`    | 厂商原生 1M 上下文、最大 128K 输出；部分网关上限可能更低，控制台可用性需确认 |
| **MiniMax M3** ⭐ | `MiniMax-M3` | 厂商原生多模态 1M 上下文；部分网关仅开放 192K，控制台可用性需确认       |
| **文心一言 4.0**     | `ernie-4.0`  | 历史兼容模型                                      |
| **智谱 GLM-4**     | `glm-4`      | 历史兼容模型                                      |
| **讯飞星火 3.5**     | `spark-3.5`  | 历史兼容模型                                      |

## 💰 定价说明

### 计费方式

* **按量计费**：根据实际使用的 Token 数量计费
* **无最低消费**：充多少用多少，余额永不过期
* **实时扣费**：每次调用后立即从余额扣除费用

### 价格说明

* 官方源头转发，价格略有优势
* 批量使用可联系客服获取更便于成本核算价格
* 实际余额和扣费以控制台显示为准

### 查看实时价格

访问 [老张API控制台定价页面](https://api2.laozhang.ai/account/pricing) 查看所有模型的最新价格。

## 🛠️ 模型选择指南：如何选择最适合的AI模型

### 按使用场景选择模型

**编程开发** 💻

* 首选：GPT-5.6 Sol、Claude Sonnet 5、Claude Opus 4.8、Grok 4.5
* 备选：GPT-5.6 Terra、Claude Opus 4.7、Gemini 3.6 Flash、Gemini 3.1 Pro Preview、Qwen3-Coder-480B
* 经济型：GPT-5.6 Luna、Gemini 3.5 Flash-Lite、DeepSeek V4 Flash、Qwen 3.6 Flash

**文本创作** ✍️

* 首选：GPT-5.6 Sol、Claude Sonnet 5、Claude Opus 4.8
* 备选：GPT-5.6 Terra、Grok 4.5、Gemini 3.6 Flash、Claude Opus 4.7
* 中文优化：Qwen 3.7 Max / Plus、Kimi K3、DeepSeek V4 Pro

**复杂推理** 🧠

* 首选：Claude Fable 5、GPT-5.6 Sol（Pro 模式）、Claude Opus 4.8
* 备选：GPT-5.6 Sol、Grok 4.5、Gemini 3.1 Pro Preview
* 轻量级：DeepSeek V4 Flash、Qwen 3.6 Flash、o4-mini

**快速响应** ⚡

* 首选：Gemini 3.6 Flash、Claude Sonnet 5、Claude Haiku 4.5
* 备选：GPT-5.6 Terra、Grok 4.3、Gemini 3.5 Flash、Gemini 2.5 Flash
* 经济型：Gemini 3.5 Flash-Lite、GPT-5.6 Luna、Gemini 2.5 Flash Lite

**图像生成** 🎨

* 顶级质量：GPT-Image-2、Gemini 3 Pro Image（Nano Banana Pro）、Flux Kontext Max
* 平衡选择：Gemini 3.1 Flash Image（Nano Banana 2）、GPT-Image-2 VIP、Flux Kontext Pro
* 成本控制：Gemini 3.1 Flash Lite Image（Nano Banana 2 Lite）、Gemini 2.5 Flash Image
* 国产选择：Seedream 4.5

**视频生成** 🎬

* 专业级：Seedance 2.0、`veo-3.1-generate-preview`、Wan 2.7、Sora 2 Pro
* 特殊需求：Seedance 2.0（多模态参考/视频编辑）、Wan 2.7 R2V / Video Edit
* 快速版：Seedance 2.0 Fast、`veo-3.1-fast-generate-preview`
* OpenAI 路线：当前官方转发使用 `sora-2` / `sora-2-pro`；旧 `sora_video2*` 与角色别名仅用于迁移排查

**长文本处理** 📄

* 首选：Claude Fable 5、Claude Opus 4.8、GPT-5.6 Sol、Gemini 3.1 Pro Preview
* 高质量：GPT-5.6 Terra、Claude Sonnet 5、Grok 4.3
* 备选：Gemini 3.6 Flash、Qwen 3.7 Max、Kimi K3

**联网搜索** 🔍

* 优先评估支持服务端 Web / X Search 工具的 Grok 4.5，以及支持搜索接地的 Gemini 模型；工具费用与模型 token 费用可能分开计算

**多模态理解** 🖼️

* 图文理解：GPT-5.6 Sol、Claude Opus 4.8、Gemini 3.6 Flash、Gemini 3.1 Pro Preview
* 视觉问答：Claude Sonnet 5、Grok 4.5、Doubao 1.5 Vision Pro

### 成本优化建议

1. **分级使用**：简单任务用成本较低模型，复杂任务用高级模型
2. **测试优化**：先用小模型测试，确定需求后再用大模型
3. **批量处理**：大量相似任务可以选择 Nano 或 Mini 版本
4. **缓存复用**：对重复查询结果进行缓存

## 🔗 相关资源

* [模型对比测试](https://yingtu.ai) - 图像生成效果对比
* [实时价格查询](https://api2.laozhang.ai/account/pricing) - 最新定价信息
* [API 文档](/api-manual) - 详细接口说明
* [快速开始](/getting-started) - 集成指南
* [OpenAI GPT-5.6 模型目录](https://developers.openai.com/api/docs/models) - Sol、Terra、Luna 的官方模型 ID 与上下文说明
* [OpenAI GPT-5.6 使用指南](https://developers.openai.com/api/docs/guides/latest-model) - 别名、推理强度与 Pro 模式说明
* [OpenAI 图像生成指南](https://developers.openai.com/api/docs/guides/image-generation) - GPT-Image-2 尺寸、质量与输出约束
* [Anthropic Claude Fable 5 公告](https://www.anthropic.com/news/claude-fable-5-mythos-5) - 官方模型 ID 与可用范围
* [Anthropic Claude Opus 4.8 公告](https://www.anthropic.com/news/claude-opus-4-8) - 官方模型 ID 与 1M 上下文说明
* [Anthropic Claude Sonnet 5 公告](https://www.anthropic.com/news/claude-sonnet-5) - 官方模型 ID 与发布状态
* [Google Gemini 3.6 Flash](https://ai.google.dev/gemini-api/docs/models/gemini-3.6-flash) - 最新稳定 Flash 的官方能力与上下文说明
* [Google Gemini 3.5 Flash-Lite](https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite) - 最新稳定轻量模型的官方说明
* [Google Gemini 3.1 Flash Lite Image](https://ai.google.dev/gemini-api/docs/models/gemini-3.1-flash-lite-image) - Nano Banana 2 Lite 的 1K 与 14 种宽高比说明
* [xAI Grok 4.5 模型页](https://docs.x.ai/developers/models/grok-4.5) - 官方模型 ID 与上下文说明
* [xAI Grok Imagine Image Quality](https://docs.x.ai/developers/models/grok-imagine-image-quality) - 当前高质量图像模型与别名
* [xAI Grok Imagine Video 1.5](https://docs.x.ai/developers/models/grok-imagine-video-1.5) - 当前视频模型及仅支持图像输入的限制
* [DeepSeek API 更新日志](https://api-docs.deepseek.com/updates/) - V4 模型与旧别名退役日期
* [阿里云百炼文本模型列表](https://help.aliyun.com/zh/model-studio/text-generation-model) - Qwen、DeepSeek、Kimi、GLM 等模型参数
* [Moonshot Kimi 模型列表](https://platform.kimi.ai/docs/models) - K3、K2.7 Code 的官方 ID 与上下文
* [智谱 GLM-5.2 文档](https://docs.bigmodel.cn/cn/guide/models/text/glm-5.2) - 原生上下文与输出上限
* [MiniMax 模型发布日志](https://platform.minimaxi.com/docs/release-notes/models) - MiniMax M3 发布时间与能力说明
* [Sora 2 官方 API 转发](/api-capabilities/sora2/official-forward) - 老张API当前 Sora 2 路线与令牌要求
* [Veo 3.1 官方 API 转发](/api-capabilities/veo/official-forward) - 老张API当前 Veo 模型 ID 与令牌要求

<Note>
  模型列表持续更新中，我们会及时添加最新发布的优秀模型。如需使用特定模型或有批量需求，请联系客服。
</Note>
