ヘッジとは何か、そしてなぜ回答にはそれが満ちているのか
ヘッジは回答を包む修飾語の層です。「場合による」「一般的に」「専門家に相談してください」などです。書き手にはコストがかからず、読者には具体的な答えを奪います。モデルはヘッジされた回答の方が間違いにくいと学習します。
回答が完全でも、有用な部分が修飾語の下に埋もれていれば無用です。パターンを認識することが最初のステップです。ヘッジを警戒心ではなく形として捉えれば、それを避けて質問できます。
ヘッジはトピックではなく形である
4つの同じ動きが、主題に関係なく現れます。順位を付けずに複数の可能性を挙げ、質問を文脈として繰り返す、無名の専門家に委ねる、そして状況が異なることをreminderで閉じる。これら4つはすべて真実です。それらはあらゆる結果に耐える段落を生成します。しかし、決定を下す必要がある人にとって、その段落は無価値です。
ルールを書いたのは誰でもない、モデルが学習した
トレーニングは、レビューアーが安全で有用と評価する回答を報酬として与えます。ヘッジされた回答はめったに安全ではないと評価されません。直接的な回答は Occasionally 誤りと評価されます。何百万もの比較を通じて勾配は一方へ向かい、モデルは「慎重になれ」というルールが書かれなくても慎重さへと到達します。
ある種のヘッジは誠実である
回答がモデルが知らない何かに本当に依存している場合、それを言うのは正しいことです。テストは、修飾語が不足している情報を特定するかどうかです。「管轄区域による」は有用です。管轄区域を供給できるからです。「多くの要因による」は有用ではありません。あなたが追加できるものは何もそれを解決しないからです。
それを避けて質問する
不足している情報を自分で特定することで、ヘッジの言い訳を取り除きます。質問に仮定を述べ、仮定が満たされる場合に望む単一の答えを言い、答えをまず、そして注意点を後に尋ねてください。順序は言葉遣いよりも重要です。答えの後に置かれた注意点は情報であり、答えの前に置かれた注意点はそれの代わりになります。
妥当な質問
ヘッジは拒否と同じですか?
いいえ。拒否は答えを辞退し、それを伝えます。ヘッジはコミットしない回答風の段落を生成します。それは気づきにくく、したがってあなたの時間をより多く浪費します。
より大きなモデルはヘッジが少ないですか?
確実ではありません。ヘッジはモデルの大きさではなく、モデルのチューニング方法に由来します。直接的さをチューニングされた小さなモデルは、慎重さをチューニングされたより大きなモデルよりもヘッジが少ないでしょう。
修飾語なしの答えを求められますか?
求められますが、それには注意が必要です。真の情報を含む修飾語は残すべきです。あなたが除去したいのは、情報を持たない修飾語です。
ここに質問して、返信のどれくらいが答えなのかを確認してください。
無検閲チャットを開く