- 发布日期:2026年7月30日
- 最后核对:2026年8月1日
- 当前状态:有效;
gpt-5.6-luna与gpt-5.6-terra已执行新价格,gpt-5.6-sol价格不变
最新价格
以下均为每 100 万 tokens 的美元价格,适用于输入 prompt tokens 不超过 272K 的标准请求。本表说明 GPT-5.6 系列标准 token 价格。特殊令牌分组、服务档位或其他计费方式仍以控制台模型与价格页面和调用日志为准。
超过 272K 输入 tokens 时如何计费?
当单次请求的输入 prompt 超过 272K tokens 时,OpenAI 对整次请求采用 2 倍输入价格和 1.5 倍输出价格。按最新基础价格计算:
长上下文倍率作用于整次请求,不是只对超过 272K 的部分加价。正式估算成本时,应使用完整输入 token 数,并在调用后通过控制台日志核对实际扣费。
为什么能够降价?
OpenAI 表示,价格下调来自模型、推理系统和 Agent 执行框架的整体效率提升,包括更高效的生产软件、硬件调度与上下文管理。在人工主导的研发流程中,GPT-5.6 Sol 还参与重写和优化生产内核、运行 token 生成实验;OpenAI 披露这些内核优化使端到端服务成本降低约 20%,相关实验使 token 生成效率提升超过 15%。谁会受到影响?
- 正在调用
gpt-5.6-luna的用户会自动按新价格计费,适合重新评估批量分类、抽取和高吞吐 Agent 工作负载的成本; - 正在调用
gpt-5.6-terra的用户会自动获得 20% 的价格下调; gpt-5.6-sol的标准价格和长上下文价格均保持不变;- API Key、
https://api2.laozhang.ai/v1基础地址、模型 ID、Chat Completions 与 Responses API 调用方式均无需调整。
用户需要做什么?
- 无需修改代码:继续使用现有 API Key、接口和模型名称即可。
- 更新成本预算:使用上方新价格重新计算 Luna 与 Terra 的批量任务和 Agent 工作流成本。
- 检查长上下文请求:输入 prompt 可能超过 272K tokens 时,按整次请求的长上下文档位估算。
- 核对实际扣费:在控制台模型与价格页面确认令牌分组,并通过调用日志核对 token 用量与账单。
常见问题
需要更换 API Key、接口地址或模型名称吗?
不需要。本次调整只改变价格,不改变老张API现有 API Key、基础地址、模型 ID 或请求格式。超过 272K 后只对超出的 tokens 加价吗?
不是。只要输入 prompt 超过 272K tokens,2 倍输入和 1.5 倍输出的长上下文倍率就作用于整次请求。gpt-5.6-sol 也降价了吗?
没有。gpt-5.6-sol 仍为每 100 万 tokens 输入 $5.00、缓存读取 $0.50、输出 $30.00;超过 272K 输入 tokens 时,输入和输出分别为 $10.00 与 $45.00。