在上一篇文章中,我们详细梳理了GPT-5.6专用提示词指南[^1]的内容。作为续篇,本文将其与OpenAI公开的另一份指南——面向普通用户的“Prompt engineering”指南[^2]——进行对比,简要总结“归根结底,与传统提示词相比究竟改变了什么”。
结论 — 从“精确的指示”到“成果的定义”
将两份官方指南并置,可以整理如下。
| 面向普通用户的指南的基本方针[^2] | GPT-5.6专用指南的方针[^1] | |
|---|---|---|
| 对模型的比喻 | GPT模型是“新人”,需要明确的指示 | 无比喻。前提是把路径的选择交给模型 |
| 推荐的写法 | 精确而明确的指示 | 定义成果、约束、依据与完成标准 |
| 对步骤的处理 | 将任务分解为子请求并逐一确认 | 不规定步骤,描述“目的地” |
| 效果的佐证 | 未记载 | 评测分数+10~15%,token −41~66%,成本 −33~67%(内部编码代理评测的部分样本,因工作负载而异) |
以下逐一查看各自的依据。
传统的基本方针 — “GPT模型是新人,需要精确的指示”
面向普通用户的“Prompt engineering”指南,以人作比喻来说明如何向模型撰写指示。
A reasoning model is like a senior co-worker. You can give them a goal to achieve and trust them to work out the details. A GPT model is like a junior coworker. They’ll perform best with explicit instructions to create a specific output.
(推理模型就像资深同事,把要达成的目标交给它,就可以放心地把细节交由它处理。GPT模型则像新人同事,只有在获得用以生成特定输出的明确指示时,才能发挥出最佳表现。)
同一份指南接着还说道:
Generally speaking, reasoning models will provide better results on tasks with only high-level guidance. This differs from GPT models, which benefit from very precise instructions.
(一般而言,推理模型即使只有高层次的指引也能给出更好的结果。这与GPT模型不同,GPT模型得益于非常精确的指示。)
关于跨多个步骤的任务的处理,同一份指南的“Agentic tasks”条目也如下所述,推荐一种把步骤明示出来的做法——将任务分解并逐一确认。
Decompose the user’s query into all required sub-requests, and confirm that each is completed.
(将用户的请求分解为所有必要的子请求,并确认每一项都已完成。)
以上便是许多工程师所熟悉的“将任务分解为步骤,并向模型详细指示”这种写法在官方指南中的依据。
GPT-5.6专用指南的方针 — 交出成果,把路径交给模型
而面向GPT-5.6 Sol的专用指南,则把下面这句话作为前提提出(上一篇文章已详细论述的内容)。
GPT-5.6 works best when prompts define the outcome, important constraints, available evidence, and completion bar, then leave room for the model to choose an efficient path.
(GPT-5.6在提示词定义了成果、重要的约束、可用的依据与完成标准,并在此基础上把高效路径的选择交给模型时,能发挥出最佳表现。)
在此基础上,它称一种削减指示、使之精简的配置伴随有如下数值。
In a sample of internal coding-agent eval runs, configurations with leaner system prompts improved evaluation scores by roughly 10–15% while reducing total tokens by 41–66% and cost by 33–67%. Results will vary by workload, so treat these ranges as directional and validate changes on representative tasks from your own application.
(在内部编码代理评测的部分样本中,采用更精简系统提示词的配置在使评测分数提升约10~15%的同时,将总token数削减了41~66%、成本削减了33~67%。由于结果因工作负载而异,应将这些数值作为指示方向的参考值来对待,并在能代表自己应用的任务上加以验证。)
这些数值并未在聊天或写作等其他用途中被证明能带来同等程度的改善,指南自身也要求将其作为随工作负载而变化的参考值来对待。
面向普通用户的指南所举出的“对新人要分解为子请求”的方针,与专用指南所举出的“不是步骤而是成果”的方针,指向的是相反的方向。专用指南并没有把这一差异与面向普通用户的指南明确加以对比,但就GPT-5.6这同一个模型而言,关于指示写法的两种不同推荐正以官方形式并存。
把同一请求写成两种
专用指南给出的实际示例如下。
Resolve the customer's issue end to end.
Success means:
- make the eligibility decision from available policy and account evidence
- complete any allowed action before responding
- return completed_actions, customer_message, and blockers
- if required evidence is missing, ask for the smallest missing field以此为基础,将同一请求改写为面向普通用户的指南的方针(把步骤明示出来的写法),则如下所示(并非OpenAI的示例,而是本文为对比而制作的)。
1. 阅读客户的咨询内容,确认合同与使用条款
2. 判断是否具备使用资格
3. 如具备资格,则执行退款、换货等处理
4. 将处理内容加以概括并回复客户
5. 若中途信息不足,则向负责人确认后再继续前者定义了“什么被视为完成”(成功的条件),而将通往那里的步骤的组织交给模型。后者则把步骤本身从1到5一一指定,模型的角色更接近于按顺序执行所指示的步骤。专用指南之所以报告评测分数的提升与token的削减,是因为在许多场合下,前者的写法更便于模型选择高效的路径。
与自主任务的关系
专用指南中也有一节论述在跨多个步骤的任务中如何汇报。其方针是:在首次工具调用之前给出简短的前言,此后仅在局面发生重大变化时才更新。
Do not ask the model to narrate routine tool calls.
(不要让模型对日常性的工具调用逐一实况说明。)
需要说明的是,专用指南的正文(2026年7月16日时点的存档)中,并未针对Codex或ChatGPT Agent进行说明。OpenAI的文档此后已经更新,相关的现行Model guidance中设有名为“Migrate with Codex”的一节。关于自主的长时间任务中行为的细节,在上一篇文章中已有论述。
从“撰写指示”到“设计任务”
综上梳理,面向普通用户的指南所示的“对GPT模型要给出精确的指示”这一方针,在OpenAI的官方文档上,至今并未被撤回。在此之上,就GPT-5.6而言,专用指南连同实测数据一起推荐一种定义成果、约束、依据与完成标准的写法。如何解读这两种方针的并存,属于本文的考察,但至少就以GPT-5.6为对象而言,人所承担的工作的重心,似乎正从撰写详细指示这一“步骤”,向定义成果与约束的外框这一“任务的设计”转移。
小结
- OpenAI面向普通用户的“Prompt engineering”指南将GPT模型比作“需要精确指示的新人”,推荐将任务分解为子请求并逐一确认的写法
- GPT-5.6专用的提示词指南推荐定义成果、约束、依据与完成标准,并把路径的选择交给模型的写法。它举出的效果——评测分数+10~15%、token −41~66%、成本 −33~67%——出自内部编码代理评测的部分样本,指南自身也注明其会随工作负载而变动
- 即便是同一请求,“从1到5依序指定步骤的写法”与“仅定义成功条件的写法”,在交给模型的范围上有很大差异
- 两份指南并未明确对比各自的方针,面向普通用户的指南的“精确指示”方针也并未被撤回。尽管如此,就GPT-5.6而言,重心似乎正从撰写指示向设计任务转移
参考资料
- Prompting guidance for GPT-5.6 Sol — OpenAI Developers(2026年7月16日时点的存档)。详细的解说见上一篇文章。为了能以固定形式引用被引时点的内容,将存档版作为主要出处(原URL在2026年7月17日时点经确认,其显示状况因访问环境而异)。相关的现行文档为Model guidance(2026年7月17日确认)。
- Prompt engineering — OpenAI Developers(2026年7月17日确认)
