为什么问两次,会得到两个答案
采样,按设计,每次都会让措辞有所不同。对话历史,会改变模型实际在回答的东西,即使你的问题一字不差。一个处于边界上的分类,在两次运行中,可能落到任何一边。只有第三种原因,才值得你去应对。
对同一个问题得到不同的回答,读起来像是不可靠,而这三个原因里,有两个是很正常的。把它们区分开,能让你不去改写一个本来就不是问题所在的问题。
采样:措辞本来就该变化
每一个词,是从一个概率分布里选出来的,而不是作为唯一最优选项被挑出来的。这正是让文字读起来自然、而不是机械的原因。结果,是完全相同的问题,会产出措辞不同的答案,而实质内容,通常保持不变。如果事实一致,只是措辞变了,那就没有任何东西出错。
历史:你问的,其实不是同一件事
在一段进行中的对话里,模型会看到你问题之上的一切。同一句话,在第2条消息和第20条消息里问出来,是不同的输入,因为周围的文字变了。这是造成意外差异的最常见原因,而只要你开始一段新对话,它就会消失。
边界情况:这个分类判断,可能倒向任何一边
当一个问题,处于一个类别的边缘时,两次运行,可能落到相反的两边。一次回答了,另一次拒绝或犹豫。这是值得留意的情况,因为它告诉你,这个差异,来自一条边界,而不是来自主题本身,而措辞上一个微小的改变,就能把你挪出这条边界。
你遇到的是哪一种原因
对比实质内容,而不是措辞。事实一致,措辞不同,意味着采样。在一段长对话里,事实不同,意味着历史,而一段新对话,能解决这个问题。这次拒绝,下次回答,意味着边界,而这一种,值得被记住,因为它还告诉你,这个话题,其实从来就没有被真正关闭过。
合理的疑问
我能让答案可以重复吗?
一些服务,暴露出一个能去掉采样变化的设置。大多数面向消费者的聊天产品没有,因为措辞的变化,被视为一个功能,而不是一个缺陷。
连续问两次有帮助吗?
这对边界情况有帮助,对另外两种情况没有帮助。第二次尝试,落到了这条边界的另一边;它不会产出新的知识。
哪种原因,能解释一个完全相反的答案?
通常是历史。一段长对话,会把假设一路携带下去,而10条消息之前做出的一个假设,能颠倒之后的一个答案,而这两条消息,单独看起来都没有任何问题。
在这里开始一段新对话,再问一遍同样的问题。
打开无过滤聊天