default 分组按量计费,可通过 Chat Completions 或 Responses 调用,把 model 设为对应模型 ID 即可。
- 发布日期:2026 年 9 月 24 日
- 最后核对:2026 年 9 月 24 日
- 当前状态:有效;三款模型均可在
default分组调用
关键信息
价格
以下为 2026 年 9 月 24 日公开价格配置中的单价,单位为美元每 1M tokens,与 OpenAI 价格页的 Standard 价格相同。 标准请求(单次请求输入不超过 272K tokens):
长上下文请求(单次请求输入超过 272K tokens):
单次请求输入超过 272K tokens 时,整次请求都按长上下文价计费。当前单价以模型与价格总表和控制台模型与价格为准。
三款模型怎么选
OpenAI 建议根据任务需要的推理能力、延迟和成本来选:gpt-6-astra:OpenAI 称其为目前能力最强的模型,面向最难的端到端任务,适合复杂推理、编程、研究和文档创作。三款中单价最高。gpt-6-sol:面向复杂编程和 Agent 工作流,适合对推理要求较高的任务。gpt-6-luna:OpenAI 称其为效率最高的模型,适合目标明确、调用量大、需要反复执行的任务。三款中单价最低。
影响范围
- 适用:通过老张API的 OpenAI 兼容接口调用文本模型的项目。API Key 在
default分组、计费模式为按量优先或按量计费时即可调用 GPT-6,把model换成新的模型 ID 就能开始测试。 - 不受影响:本次上线没有调整已有模型。GPT-5.6、GPT-5.4 等模型继续可用,现有集成不需要修改。
调用示例
在令牌管理创建 API Key:令牌分组选default,计费模式选择按量优先(推荐)或按量计费。然后在终端设置环境变量:
gpt-6-sol 发送一条消息;Python 示例先执行 python -m pip install openai。
- cURL
- Python
choices[0].message.content,Python 示例会直接打印出来。换用 gpt-6-astra 或 gpt-6-luna 时只改 model。Python 示例关闭了 SDK 自动重试,由应用决定失败后是否重发;每次请求的 token 用量和扣费可在调用日志查看。
使用 Responses API 时,向 POST /v1/responses 发送 input:
- cURL
- Python
response.output_text 汇总了回复文本;直接读取 JSON 时,文本在 output 数组中 type 为 message 的项的 content[].text 里。
从其他模型切换时检查请求参数
GPT-6 的三款模型都是推理模型。OpenAI 在 GPT-6 使用指南中列出了切换到 GPT-6 时要检查的参数,适用于 Chat Completions 请求的规则如下:- 推理强度(
reasoning_effort):gpt-6-sol和gpt-6-luna支持none、low、medium(默认)、high、xhigh和max。gpt-6-astra不支持none,原来用none的请求改为low。- 原请求使用
minimal时,三款模型都先改为low,再比较效果。
- 采样参数:推理强度不是
none时,请求中不要带temperature、top_p、logprobs和top_logprobs。gpt-6-astra不支持none,所以调用它时始终去掉这些参数。 - 工具调用:
gpt-6-astra的工具调用需要使用 Responses API。gpt-6-sol和gpt-6-luna在 Chat Completions 中只有reasoning_effort为none时才支持函数调用。- 需要在
gpt-6-astra上使用工具,或在 Sol、Luna 上同时使用推理和函数调用时,改用老张API的 Responses 端点(POST /v1/responses)。
常见问题
可以用 Responses API 调用 GPT-6 吗?
可以。老张API兼容 OpenAI 的 Responses API:把 Base URL 设为https://api.laozhang.ai/v1,就能按 OpenAI GPT-6 指南的写法调用 client.responses.create,示例见上文调用示例。
gpt-6-astra 的工具调用需要使用 Responses API;只做普通对话时,Chat Completions 和 Responses 都可以。
输入超过 272K tokens 的请求怎么计费?
整次请求都按长上下文价计费,而不只是超出 272K 的部分。 输入、输出、缓存读取和缓存写入都使用上方「长上下文请求」表中的单价:相对标准价,输入和缓存为 2 倍,输出为 1.5 倍,与 OpenAI 的计价规则一致。估算成本时,用单次请求的完整输入 token 数判断适用哪一档。已经在用 GPT-5.6,需要换成 GPT-6 吗?
不需要马上更换。gpt-5.6-luna、gpt-5.6-terra 和 gpt-5.6-sol 仍在价格配置中,现有集成照常可用。
准备切换时,先用自己业务中有代表性的请求比较两代模型的效果、延迟和费用,再按上文检查推理强度、采样参数和工具调用。两代模型的当前单价见模型与价格总表。
调用时提示模型不存在或没有权限怎么办?
先检查模型 ID、令牌分组和端点,依次确认:- 模型 ID 是否完整复制(
gpt-6-astra、gpt-6-sol或gpt-6-luna)。 - API Key 的令牌分组是否为
default,计费模式是否为按量优先或按量计费(按次计费的令牌只能调用按次计费的模型)。 - 请求是否发到
POST /v1/chat/completions或POST /v1/responses。
如何核对 GPT-6 的扣费?
用调用日志里的 token 用量乘以当前单价,再与实际扣费对照: 两者不一致时,把请求时间和模型 ID 发给支持团队(hi@laozhang.ai),不要附上 API Key。来源与相关链接
OpenAI 官方来源- OpenAI API 更新日志:2026 年 9 月 3 日 GPT-6 Astra 和 9 月 22 日 GPT-6 Sol、Luna 的发布条目。
- OpenAI API 价格页:三款模型的标准价与长上下文价。
- GPT-6 Astra、GPT-6 Sol、GPT-6 Luna 模型页:上下文窗口、最大输出、推理强度和计价规则。
- OpenAI GPT-6 使用指南:三款模型的定位,以及切换时的参数与工具调用规则。
- 模型与价格总表:各模型的当前单价与阶梯计价。
- 控制台模型与价格:登录后查看你的账户适用的单价。
- 令牌管理:创建 API Key,设置令牌分组和计费模式。
- 调用日志:每次请求的 token 用量和实际扣费。