Unfiltered
登录 打开聊天

你从未见过的那些指令

阅读约 2 分钟

你从未见过的那些指令

每一个助手,都在一段隐藏的指令下运作,这段指令,被放在你第一条消息之前。它通常设定一个人设、一个谨慎程度、格式规则,以及一份该避免的事情清单。同一个模型,在两段不同的系统提示背后,会产出感觉像是两个不同产品的回答。

人们对比助手,得出结论说,一个模型比另一个更直接。但往往,这些模型是相似的,不同的是指令,而指令,正是没有人会公开的那部分。

本页内容
  1. 这段指令,通常包含什么
  2. 为什么在语气上,它胜过模型
  3. 长度和犹豫措辞,常常在这里被设定
  4. 从外部,你能看出什么
  5. 合理的疑问

这段指令,通常包含什么

一句人设描述,一条谨慎指令,格式偏好,以及一份需要谨慎处理的话题清单。它是用普通语言写的,而不是代码,这就是为什么它的效果,会被感受为一种个性。一句告诉助手要「乐于助人、无害」的话,能改变成千上万个回答。

为什么在语气上,它胜过模型

微调,改变的是一个模型的倾向;系统提示,则在每一次请求中,都叠加在这些倾向之上生效。当两者不一致时,摆在对话前面的那条指令,通常会获胜,因为它是模型被告知的、最新、也最具体的东西。这就是为什么同一个开放模型,在一个产品里感觉很谨慎,在另一个产品里却很直白。

长度和犹豫措辞,常常在这里被设定

像「要详尽」或「承认不确定性」这样的指令,产出了人们归咎于模型的那些铺垫和限定词。这两条指令,单独看都不算不合理。合在一起,它们产出了那种冗长、谨慎、不肯表态的回答,而这正是大多数助手默认给出的体验。

从外部,你能看出什么

你无法读到这段指令,但你能测量它。要求一个一句话的答案:一个依然给出三段话的服务,说明它有一条超越了你的要求的长度指令。在两个服务上问同一个事实性问题:事实一致、语气不同,指向的是指令,而不是模型。

合理的疑问

我能覆盖这个系统提示吗?

部分能,不能完全。格式要求,通常能通过,而谨慎指令,通常会保持不变,因为它们是作为约束、而不是偏好被设定的。

服务方会公开他们的系统提示吗?

极少数会。它被当作产品设计来对待,也是唯一一条能解释助手之间大部分差异的信息。

更短的系统提示更好吗?

更短,通常意味着更少相互竞争的指令,这会产出更可预测的答案。更长,不必然更差;自相矛盾才是。

在这里要求一个一句话的答案,数一数句子的数量。

打开无过滤聊天

一个答案是如何被塑造的