Skip to main content
老张API已上线 OpenAI GPT-6 Astra、Sol 与 Luna 三款模型,都在 default 分组按量计费,可通过 Chat Completions 或 Responses 调用,把 model 设为对应模型 ID 即可。
  • 发布日期:2026 年 9 月 24 日
  • 最后核对:2026 年 9 月 24 日
  • 当前状态:有效;三款模型均可在 default 分组调用

关键信息

价格

以下为 2026 年 9 月 24 日公开价格配置中的单价,单位为美元每 1M tokens,与 OpenAI 价格页的 Standard 价格相同。 标准请求(单次请求输入不超过 272K tokens): 长上下文请求(单次请求输入超过 272K tokens): 单次请求输入超过 272K tokens 时,整次请求都按长上下文价计费。当前单价以模型与价格总表控制台模型与价格为准。

三款模型怎么选

OpenAI 建议根据任务需要的推理能力、延迟和成本来选:
  • gpt-6-astra:OpenAI 称其为目前能力最强的模型,面向最难的端到端任务,适合复杂推理、编程、研究和文档创作。三款中单价最高。
  • gpt-6-sol:面向复杂编程和 Agent 工作流,适合对推理要求较高的任务。
  • gpt-6-luna:OpenAI 称其为效率最高的模型,适合目标明确、调用量大、需要反复执行的任务。三款中单价最低。
选定之前,用自己业务中有代表性的请求比较候选模型的效果、延迟和 token 用量,比较方法见选择模型

影响范围

  • 适用:通过老张API的 OpenAI 兼容接口调用文本模型的项目。API Key 在 default 分组、计费模式为按量优先或按量计费时即可调用 GPT-6,把 model 换成新的模型 ID 就能开始测试。
  • 不受影响:本次上线没有调整已有模型。GPT-5.6、GPT-5.4 等模型继续可用,现有集成不需要修改。

调用示例

令牌管理创建 API Key:令牌分组选 default,计费模式选择按量优先(推荐)或按量计费。然后在终端设置环境变量:
GPT-6 可以通过 Chat Completions 或 Responses 调用。下面先用 Chat Completions 向 gpt-6-sol 发送一条消息;Python 示例先执行 python -m pip install openai
回复文本在 choices[0].message.content,Python 示例会直接打印出来。换用 gpt-6-astragpt-6-luna 时只改 model。Python 示例关闭了 SDK 自动重试,由应用决定失败后是否重发;每次请求的 token 用量和扣费可在调用日志查看。 使用 Responses API 时,向 POST /v1/responses 发送 input
Python SDK 的 response.output_text 汇总了回复文本;直接读取 JSON 时,文本在 output 数组中 typemessage 的项的 content[].text 里。

从其他模型切换时检查请求参数

GPT-6 的三款模型都是推理模型。OpenAI 在 GPT-6 使用指南中列出了切换到 GPT-6 时要检查的参数,适用于 Chat Completions 请求的规则如下:
  • 推理强度reasoning_effort):
    • gpt-6-solgpt-6-luna 支持 nonelowmedium(默认)、highxhighmax
    • gpt-6-astra 不支持 none,原来用 none 的请求改为 low
    • 原请求使用 minimal 时,三款模型都先改为 low,再比较效果。
  • 采样参数:推理强度不是 none 时,请求中不要带 temperaturetop_plogprobstop_logprobsgpt-6-astra 不支持 none,所以调用它时始终去掉这些参数。
  • 工具调用
    • gpt-6-astra 的工具调用需要使用 Responses API。
    • gpt-6-solgpt-6-luna 在 Chat Completions 中只有 reasoning_effortnone 时才支持函数调用。
    • 需要在 gpt-6-astra 上使用工具,或在 Sol、Luna 上同时使用推理和函数调用时,改用老张API的 Responses 端点(POST /v1/responses)。

常见问题

可以用 Responses API 调用 GPT-6 吗?

可以。老张API兼容 OpenAI 的 Responses API:把 Base URL 设为 https://api.laozhang.ai/v1,就能按 OpenAI GPT-6 指南的写法调用 client.responses.create,示例见上文调用示例 gpt-6-astra 的工具调用需要使用 Responses API;只做普通对话时,Chat Completions 和 Responses 都可以。

输入超过 272K tokens 的请求怎么计费?

整次请求都按长上下文价计费,而不只是超出 272K 的部分。 输入、输出、缓存读取和缓存写入都使用上方「长上下文请求」表中的单价:相对标准价,输入和缓存为 2 倍,输出为 1.5 倍,与 OpenAI 的计价规则一致。估算成本时,用单次请求的完整输入 token 数判断适用哪一档。

已经在用 GPT-5.6,需要换成 GPT-6 吗?

不需要马上更换。gpt-5.6-lunagpt-5.6-terragpt-5.6-sol 仍在价格配置中,现有集成照常可用。 准备切换时,先用自己业务中有代表性的请求比较两代模型的效果、延迟和费用,再按上文检查推理强度、采样参数和工具调用。两代模型的当前单价见模型与价格总表

调用时提示模型不存在或没有权限怎么办?

先检查模型 ID、令牌分组和端点,依次确认:
  1. 模型 ID 是否完整复制(gpt-6-astragpt-6-solgpt-6-luna)。
  2. API Key 的令牌分组是否为 default,计费模式是否为按量优先或按量计费(按次计费的令牌只能调用按次计费的模型)。
  3. 请求是否发到 POST /v1/chat/completionsPOST /v1/responses
仍然失败时,按模型可用性说明排查。

如何核对 GPT-6 的扣费?

用调用日志里的 token 用量乘以当前单价,再与实际扣费对照:
  1. 控制台模型与价格确认三款模型的当前单价。
  2. 调用日志选一条近期请求,用它的 token 用量按单价算出应扣金额;输入超过 272K tokens 的请求按长上下文单价计算。
  3. 与实际扣费对照。
两者不一致时,把请求时间和模型 ID 发给支持团队(hi@laozhang.ai),不要附上 API Key。

来源与相关链接

OpenAI 官方来源 老张API价格与账单 老张API的单价、令牌分组和端点依据 2026 年 9 月 24 日的公开价格配置,可在以下入口查看和核对: 相关文档