Skip to main content
模型是同一个,差别在于官方网页版在模型外面加了一层封装:隐藏的系统提示词、联网搜索、对话记忆和调好的参数,API 只交付模型本身。老张API原样转发请求,不注入提示词、不改写内容,行为与直连官方 API 一致。

网页版多做了什么

常见的“结果不同”

  • 不知道最近的新闻:模型知识停在训练截止时间,网页版靠联网搜索补齐。API 需要你自己接搜索接口,把结果放进上下文。
  • 算数、数字数会出错:网页版遇到计算会悄悄写代码运行,API 里的模型只能“心算”。给模型接代码执行工具,或要求它列出计算步骤。
  • 回答更短、格式更随意:网页版的系统提示词规定了结构和长度。把你想要的风格写进自己的系统提示词。
  • 忘了前面说过的话:API 每次请求都是新对话。把历史轮次放进 messages 再发送,配合提示词缓存降低重复前缀的成本。
  • 每次回答都不一样:这是采样随机性。调低 temperature,或在提示词中约束输出格式。
  • 推理感觉更浅:网页版常默认较高的思考档位。显式调高 reasoning_effort 等参数,并留足输出上限,见 max_tokens 说明。

模型说错自己的名字或版本

通过 API 问“你是什么模型”,回答错版本号是正常现象,不代表调用的模型不对:
  • 模型的名字是训练完成后才定的,模型本身没有学过“我是谁”;训练数据里只有更早的模型名,所以它会猜一个见过的名字。
  • 网页版能答对,是因为隐藏的系统提示词告诉了它。
  • 请求里的 model 参数用于选择模型,模型自己读不到这个字段。
需要它正确自称时,在系统提示词里写明身份:

怎样确认实际调用的模型

不要用模型的自我介绍判断,看这两处:
  1. 响应 JSON 中的 model 字段;
  2. 调用日志中这次请求的模型名和扣费。

用 API 接近网页版效果

1

写好系统提示词

明确身份、语气、输出格式、回答长度和边界,这一步效果最明显。
2

自己维护对话历史

把每轮的用户输入和模型回复追加到 messages,对话变长后做摘要,或只保留最近几轮和关键信息。
3

按需接工具

需要时效信息就接搜索,需要精确计算就接代码执行,需要内部资料就接检索。工具调用写法见 Chat Completions 和 Claude 协议中的工具调用说明。
4

显式设置参数

不依赖默认值,写明 temperature、输出上限和思考档位。
不想从零搭建时,可以用已经内置这些能力的第三方客户端,把 API 地址设为 https://api.laozhang.ai/v1、填入老张API密钥即可,配置要点见 API Key 无效与 Base URL。 API 无法完全复刻网页版:官方不公开系统提示词,部分网页功能没有对应的 API,网页版也在持续做实验和自动换模型。反过来,API 的提示词、参数和上下文都由你控制,结果可复现,更适合做产品。

相关文档