> ## Documentation Index
> Fetch the complete documentation index at: https://docs.laozhang.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# GPT-6 Astra、Sol、Luna 上线：价格与调用

> 老张API已上线 GPT-6 Astra、Sol 与 Luna，本页给出模型 ID、标准与长上下文价格、选型依据，以及 Chat Completions 与 Responses 调用示例。

老张API已上线 OpenAI GPT-6 Astra、Sol 与 Luna 三款模型，都在 `default` 分组按量计费，可通过 Chat Completions 或 Responses 调用，把 `model` 设为对应模型 ID 即可。

* **发布日期**：2026 年 9 月 24 日
* **最后核对**：2026 年 9 月 24 日
* **当前状态**：有效；三款模型均可在 `default` 分组调用

## 关键信息

| 项目            | 内容                                                                                                                |
| ------------- | ----------------------------------------------------------------------------------------------------------------- |
| 模型 ID         | `gpt-6-astra`、`gpt-6-sol`、`gpt-6-luna`                                                                            |
| OpenAI 发布日期   | `gpt-6-astra` 为 2026 年 9 月 3 日；`gpt-6-sol`、`gpt-6-luna` 为 2026 年 9 月 22 日                                         |
| 老张API上线       | `gpt-6-astra` 于 2026 年 9 月 10 日上线；`gpt-6-sol`、`gpt-6-luna` 在 2026 年 9 月 24 日的价格配置中已可用                             |
| 调用端点          | Base URL `https://api.laozhang.ai/v1`；Chat Completions `POST /v1/chat/completions`，Responses `POST /v1/responses` |
| 令牌分组与计费       | `default` 分组，按量计费（按 tokens）                                                                                       |
| 价格            | 标准请求（输入不超过 272K tokens）与长上下文请求两档，单价见[价格](#价格)                                                                     |
| 长上下文档位        | 单次请求输入超过 272K tokens                                                                                              |
| 上下文长度（OpenAI） | 上下文窗口 1,050,000 tokens，输入最多 922,000 tokens，输出最多 128,000 tokens                                                    |

## 价格

以下为 2026 年 9 月 24 日公开价格配置中的单价，单位为美元每 1M tokens，与 [OpenAI 价格页](https://developers.openai.com/api/docs/pricing)的 Standard 价格相同。

**标准请求**（单次请求输入不超过 272K tokens）：

| 模型            |    输入 |    输出 |   缓存读取 |    缓存写入 |
| ------------- | ----: | ----: | -----: | ------: |
| `gpt-6-astra` |  \$10 |  \$50 |    \$1 |  \$12.5 |
| `gpt-6-sol`   |   \$2 |  \$10 |  \$0.2 |   \$2.5 |
| `gpt-6-luna`  | \$0.1 | \$0.5 | \$0.01 | \$0.125 |

**长上下文请求**（单次请求输入超过 272K tokens）：

| 模型            |    输入 |     输出 |   缓存读取 |   缓存写入 |
| ------------- | ----: | -----: | -----: | -----: |
| `gpt-6-astra` |  \$20 |   \$75 |    \$2 |   \$25 |
| `gpt-6-sol`   |   \$4 |   \$15 |  \$0.4 |    \$5 |
| `gpt-6-luna`  | \$0.2 | \$0.75 | \$0.02 | \$0.25 |

单次请求输入超过 272K tokens 时，整次请求都按长上下文价计费。当前单价以[模型与价格总表](/models)和[控制台模型与价格](https://api.laozhang.ai/account/pricing)为准。

## 三款模型怎么选

OpenAI 建议根据任务需要的推理能力、延迟和成本来选：

* **`gpt-6-astra`**：OpenAI 称其为目前能力最强的模型，面向最难的端到端任务，适合复杂推理、编程、研究和文档创作。三款中单价最高。
* **`gpt-6-sol`**：面向复杂编程和 Agent 工作流，适合对推理要求较高的任务。
* **`gpt-6-luna`**：OpenAI 称其为效率最高的模型，适合目标明确、调用量大、需要反复执行的任务。三款中单价最低。

选定之前，用自己业务中有代表性的请求比较候选模型的效果、延迟和 token 用量，比较方法见[选择模型](/api-reference/chat-completions#选择模型)。

## 影响范围

* **适用**：通过老张API的 OpenAI 兼容接口调用文本模型的项目。API Key 在 `default` 分组、计费模式为按量优先或按量计费时即可调用 GPT-6，把 `model` 换成新的模型 ID 就能开始测试。
* **不受影响**：本次上线没有调整已有模型。GPT-5.6、GPT-5.4 等模型继续可用，现有集成不需要修改。

## 调用示例

在[令牌管理](https://api.laozhang.ai/token)创建 API Key：令牌分组选 `default`，计费模式选择按量优先（推荐）或按量计费。然后在终端设置环境变量：

```bash theme={null}
export LAOZHANG_API_KEY="替换为你的老张API密钥"
```

GPT-6 可以通过 Chat Completions 或 Responses 调用。下面先用 Chat Completions 向 `gpt-6-sol` 发送一条消息；Python 示例先执行 `python -m pip install openai`。

<Tabs>
  <Tab title="cURL">
    ```bash theme={null}
    curl https://api.laozhang.ai/v1/chat/completions \
      -H "Authorization: Bearer $LAOZHANG_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{
        "model": "gpt-6-sol",
        "messages": [
          {"role": "user", "content": "用三句话解释什么是数据库索引。"}
        ]
      }'
    ```
  </Tab>

  <Tab title="Python">
    ```python theme={null}
    import os
    from openai import OpenAI

    client = OpenAI(
        api_key=os.environ["LAOZHANG_API_KEY"],
        base_url="https://api.laozhang.ai/v1",
        timeout=300.0,
        max_retries=0,
    )
    response = client.chat.completions.create(
        model="gpt-6-sol",
        messages=[{"role": "user", "content": "用三句话解释什么是数据库索引。"}],
    )
    print(response.choices[0].message.content)
    ```
  </Tab>
</Tabs>

回复文本在 `choices[0].message.content`，Python 示例会直接打印出来。换用 `gpt-6-astra` 或 `gpt-6-luna` 时只改 `model`。Python 示例关闭了 SDK 自动重试，由应用决定失败后是否重发；每次请求的 token 用量和扣费可在[调用日志](https://api.laozhang.ai/log)查看。

使用 Responses API 时，向 `POST /v1/responses` 发送 `input`：

<Tabs>
  <Tab title="cURL">
    ```bash theme={null}
    curl https://api.laozhang.ai/v1/responses \
      -H "Authorization: Bearer $LAOZHANG_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{
        "model": "gpt-6-sol",
        "input": "用三句话解释什么是数据库索引。"
      }'
    ```
  </Tab>

  <Tab title="Python">
    ```python theme={null}
    import os
    from openai import OpenAI

    client = OpenAI(
        api_key=os.environ["LAOZHANG_API_KEY"],
        base_url="https://api.laozhang.ai/v1",
        timeout=300.0,
        max_retries=0,
    )
    response = client.responses.create(
        model="gpt-6-sol",
        input="用三句话解释什么是数据库索引。",
    )
    print(response.output_text)
    ```
  </Tab>
</Tabs>

Python SDK 的 `response.output_text` 汇总了回复文本；直接读取 JSON 时，文本在 `output` 数组中 `type` 为 `message` 的项的 `content[].text` 里。

## 从其他模型切换时检查请求参数

GPT-6 的三款模型都是推理模型。OpenAI 在 [GPT-6 使用指南](https://developers.openai.com/api/docs/guides/latest-model)中列出了切换到 GPT-6 时要检查的参数，适用于 Chat Completions 请求的规则如下：

* **推理强度**（`reasoning_effort`）：
  * `gpt-6-sol` 和 `gpt-6-luna` 支持 `none`、`low`、`medium`（默认）、`high`、`xhigh` 和 `max`。
  * `gpt-6-astra` 不支持 `none`，原来用 `none` 的请求改为 `low`。
  * 原请求使用 `minimal` 时，三款模型都先改为 `low`，再比较效果。
* **采样参数**：推理强度不是 `none` 时，请求中不要带 `temperature`、`top_p`、`logprobs` 和 `top_logprobs`。`gpt-6-astra` 不支持 `none`，所以调用它时始终去掉这些参数。
* **工具调用**：
  * `gpt-6-astra` 的工具调用需要使用 Responses API。
  * `gpt-6-sol` 和 `gpt-6-luna` 在 Chat Completions 中只有 `reasoning_effort` 为 `none` 时才支持函数调用。
  * 需要在 `gpt-6-astra` 上使用工具，或在 Sol、Luna 上同时使用推理和函数调用时，改用老张API的 Responses 端点（`POST /v1/responses`）。

## 常见问题

### 可以用 Responses API 调用 GPT-6 吗？

可以。老张API兼容 OpenAI 的 Responses API：把 Base URL 设为 `https://api.laozhang.ai/v1`，就能按 OpenAI GPT-6 指南的写法调用 `client.responses.create`，示例见上文[调用示例](#调用示例)。

`gpt-6-astra` 的工具调用需要使用 Responses API；只做普通对话时，Chat Completions 和 Responses 都可以。

### 输入超过 272K tokens 的请求怎么计费？

整次请求都按长上下文价计费，而不只是超出 272K 的部分。

输入、输出、缓存读取和缓存写入都使用上方「长上下文请求」表中的单价：相对标准价，输入和缓存为 2 倍，输出为 1.5 倍，与 OpenAI 的计价规则一致。估算成本时，用单次请求的完整输入 token 数判断适用哪一档。

### 已经在用 GPT-5.6，需要换成 GPT-6 吗？

不需要马上更换。`gpt-5.6-luna`、`gpt-5.6-terra` 和 `gpt-5.6-sol` 仍在价格配置中，现有集成照常可用。

准备切换时，先用自己业务中有代表性的请求比较两代模型的效果、延迟和费用，再按上文检查推理强度、采样参数和工具调用。两代模型的当前单价见[模型与价格总表](/models)。

### 调用时提示模型不存在或没有权限怎么办？

先检查模型 ID、令牌分组和端点，依次确认：

1. 模型 ID 是否完整复制（`gpt-6-astra`、`gpt-6-sol` 或 `gpt-6-luna`）。
2. API Key 的令牌分组是否为 `default`，计费模式是否为按量优先或按量计费（按次计费的令牌只能调用按次计费的模型）。
3. 请求是否发到 `POST /v1/chat/completions` 或 `POST /v1/responses`。

仍然失败时，按[模型可用性说明](/faq/model-availability)排查。

### 如何核对 GPT-6 的扣费？

用调用日志里的 token 用量乘以当前单价，再与实际扣费对照：

1. 在[控制台模型与价格](https://api.laozhang.ai/account/pricing)确认三款模型的当前单价。
2. 到[调用日志](https://api.laozhang.ai/log)选一条近期请求，用它的 token 用量按单价算出应扣金额；输入超过 272K tokens 的请求按长上下文单价计算。
3. 与实际扣费对照。

两者不一致时，把请求时间和模型 ID 发给支持团队（[hi@laozhang.ai](mailto:hi@laozhang.ai)），不要附上 API Key。

## 来源与相关链接

**OpenAI 官方来源**

* [OpenAI API 更新日志](https://developers.openai.com/api/docs/changelog)：2026 年 9 月 3 日 GPT-6 Astra 和 9 月 22 日 GPT-6 Sol、Luna 的发布条目。
* [OpenAI API 价格页](https://developers.openai.com/api/docs/pricing)：三款模型的标准价与长上下文价。
* [GPT-6 Astra](https://developers.openai.com/api/docs/models/gpt-6-astra)、[GPT-6 Sol](https://developers.openai.com/api/docs/models/gpt-6-sol)、[GPT-6 Luna](https://developers.openai.com/api/docs/models/gpt-6-luna) 模型页：上下文窗口、最大输出、推理强度和计价规则。
* [OpenAI GPT-6 使用指南](https://developers.openai.com/api/docs/guides/latest-model)：三款模型的定位，以及切换时的参数与工具调用规则。

**老张API价格与账单**

老张API的单价、令牌分组和端点依据 2026 年 9 月 24 日的公开价格配置，可在以下入口查看和核对：

* [模型与价格总表](/models)：各模型的当前单价与阶梯计价。
* [控制台模型与价格](https://api.laozhang.ai/account/pricing)：登录后查看你的账户适用的单价。
* [令牌管理](https://api.laozhang.ai/token)：创建 API Key，设置令牌分组和计费模式。
* [调用日志](https://api.laozhang.ai/log)：每次请求的 token 用量和实际扣费。

**相关文档**

* [OpenAI 模型接入：端点、SDK 配置与价格](/api-reference/openai)
* [OpenAI 协议：Chat Completions](/api-reference/chat-completions)
* [文本生成 API：协议选择与常用模型](/api-capabilities/text-generation)
* [GPT-5.6 Sol 降价公告](/announcements/gpt-5-6-sol-price-cut-2026-09)
* [老张API最新公告](/changelog)
