Unfiltered
ログイン
チャットを開く

あなたが目にする機会のない指示

2分で読めます

あなたが目にする機会のない指示

すべてのアシスタントは、最初のメッセージの前に配置された隠れた指示ブロックで動作します。通常、これはペルソナ、慎重さのレベル、フォーマットルール、および避けるべき事項のリストを設定します。同じモデルでも、異なるシステムプロンプトの下では、まるで別々の製品のような回答が生成されます。

人々はアシスタントを比較し、あるモデルが他よりも直接的であると結論付けます。しかし、モデルは似通っており、異なるのは指示であり、その指示は公開されない部分です。

このページの内容
  1. ブロックには通常何が含まれるか
  2. なぜトーンにおいてモデルを上回るのか
  3. 長さや曖昧さの多くはここで設定される
  4. 外部から何を読み取れるか
  5. 妥当な質問

ブロックには通常何が含まれるか

ペルソナを示す一文、慎重さに関する指示、フォーマットへの好み、そして慎重に扱うべき主題のリストが含まれます。これはコードではなく通常の言語で書かれているため、その効果は人格として感じられます。アシスタントに「親切で無害であれ」という一文だけで、数千の回答が変化します。

なぜトーンにおいてモデルを上回るのか

ファインチューニングはモデルの傾向を変えますが、システムプロンプトはそれらの上にすべてのリクエストで適用されます。両者が矛盾する場合、会話の直前に置かれた指示が勝つのが一般的です。それはモデルに伝えられた最も最新で具体的な指示だからです。これが、同じオープンモデルが一つの製品では慎重で、別の製品では率直に感じられる理由です。

長さや曖昧さの多くはここで設定される

「詳細に記述せよ」や「不確実性を認めよ」といった指示は、人々がモデルのせいだと非難する冗長な文章や修飾語を生み出します。これらの指示は単独では不合理ではありません。しかし、両方が組み合わさると、多くのアシスタントのデフォルト体験となる、長く慎重で確定的でない回答が生成されます。

外部から何を読み取れるか

ブロックは直接読めませんが、測定は可能です。「1文で答えて」と依頼してください。それでも3段落の回答が返ってくる場合、あなたの指示を上回る長さの指示が設定されています。2つのサービスで同じ事実に基づく質問を行い、事実が一致していてもトーンが異なる場合、それはモデルではなく指示に起因しています。

妥当な質問

システムプロンプトを上書きできますか?

部分的には可能ですが、完全ではありません。フォーマットに関するリクエストは通常通りますが、慎重さに関する指示は通常維持されます。これらは好ましい条件ではなく、制約として配置されているためです。

サービスはシステムプロンプトを公開していますか?

非常に少ないです。それは製品設計として扱われ、アシスタント間の大部分の違いを説明しうる唯一の情報です。

短いシステムプロンプトの方が良いですか?

短いことは通常、競合する指示が少ないことを意味し、より予測可能な回答を生み出します。長いことが自動的に悪いわけではありません。問題となるのは矛盾です。

ここで1文の回答を依頼し、文の数を数えてみてください。

無検閲チャットを開く

回答が形作られる仕組み