Wiki / Core Features / AI応答 / AIメモリー

AIメモリー

更新者 Maxime_48 · 1時間前 · 閲覧数:238

言語: English Français Deutsch Español Português (Brasil) Italiano Nederlands Polski Türkçe Русский 日本語 한국어 中文

AIメモリーを使うと、YAWBDBはサーバーに関する役立つ文脈を保存でき、AIの返信が時間とともに一貫したものになります。

メモリーに書き込むのは2つです。パネルから書き込むあなたと、Discordでの会話から学んだことを書き留めるbotです。メモリーシステムはパネルで管理され、その中身が自動的に削除されることは一切ありません。

サーバーの有効な事実と無効化された事実を一覧にしたAIメモリーのページ。表の上にメモリータイプの内訳カードがある


🧠 メモリーの使い道

メモリーは、AIが次のような情報を覚えておくのに役立ちます。

  • サーバーの世界観
  • コミュニティに関する事実
  • 好みの口調
  • お決まりのネタ
  • ユーザーやロールに関する文脈
  • サーバー固有の用語
  • 大切なルールやリマインダー

目的は、AIの返信がサーバーをよく理解しているように感じられるようにすることです。


📒 メモリーページ

メモリーページでは、権限のあるユーザーが保存されているメモリーのエントリーをすべて確認できます。

このページでは次のことができます。

  • サーバーごとにメモリーを表示する
  • キーまたは内容で検索する
  • 新しいメモリーを手動で追加する
  • 既存のメモリーを編集する
  • 古くなったメモリーを削除する
  • 信頼度の値を確認する

🔎 絞り込みとページ分割

メモリーはサーバーで絞り込め、その場で検索できます。

メモリーが多い場合はページ分割されるので、ページが使いやすいまま保たれます。


✍️ メモリーを手動で追加する

AIに特定のことを知っておいてほしいときは、メモリーのエントリーを手動で追加できます。

例:

  • server_theme: This server is about retro gaming.
  • bot_tone: Replies should be friendly and concise.
  • important_rule: Do not give support in public channels; direct users to tickets.

短くわかりやすいエントリーにしましょう。必要でない限り、長い文章を詰め込むのは避けてください。


✏️ メモリーを編集する

次の項目を編集できます。

  • キー
  • コンテンツ
  • 信頼度

まだ役に立つけれど修正が必要なメモリーは、編集しましょう。

古くなった、または関係なくなったメモリーは、削除しましょう。


♻️ 知らないうちに忘れることはありません

エントリーが自動的に削除されることはありません。有効期限も、クリーンアップ処理もありません。事実は、botが自分でもう成り立たないと判断するか、誰かがこのページから削除するまで残ります。

あなたが調整できるのは、そのうちどれだけがAIに届くかです。AI応答の設定ページにある一度に注入する記憶事実の上限数で、文脈として送られる事実の数を決めます。範囲は1から1000で、既定は20です。増やすとAIが使える材料が増え、減らすと回答が引き締まります。どちらにしても何も削除されないので、自由に上げ下げできます。

古いことは、忘れる理由にはなりません。このサーバーはフランス語で話すという事実は2年経ってもそのままで、誰もそれを言い直してはくれません。

botがどう判断するか

モデルに送られる事実にはそれぞれ番号が付いており、受け取る文脈では[#12]のように表示されます。botは、ルールが変わった、誰かが好みを変えたなど、ある事実がもう成り立たないと判断すると、その番号を答えとして返し、そのエントリーは使われなくなります。削除されるのか、閲覧用に残されるのかは、下で説明するメモリータイプによって決まります。

botが取り除けるのは、そのやり取りで実際に見せられた事実だけです。目の前になかった番号を挙げても、何も起きません。推測した番号では、同じサーバーの別の会話にある事実には、実在するものであっても届きません。

これが、一度に注入する記憶事実の上限数が二重に重要である理由です。モデルに届かない事実は、モデルが見直すこともできず、誰かがこのページから削除するまで残り続けます。検索可能なアーカイブでは、これは行き止まりではなくなります。botが検索で見つけた事実は、botが訂正することもできるからです。


🧭 メモリータイプを選ぶ

メモリーの種類はサーバーごとに1つ選ぶもので、AI応答の設定ページではなく、このメモリーページで行います。botが知っていることをどう保存し、どう取り出すかが決まり、クリックした瞬間に保存されます。ドロップダウンではありません。クリックすると、6つのタイプがページの上に並んで開き、それぞれについて、何をするか、何が変わるか、切り替えると何が動くか、そしてどこで詳しく読めるかが表示されます。

ページの上部には、6つのタイプが1本のスケールとして描かれ、ピッカーを開く前から、あなたのサーバーの現在位置が示されています。

AI応答の設定ページには、有効なタイプに付随する設定が引き続きあります。ランキングの重み(新しさ、重要度、関連性)、注入される事実の数、バックグラウンドの統合パスやセマンティック埋め込みに使うモデルです。このページには、それぞれがどこにあるかが正確に書かれているので、探し回る必要はありません。

Classicは現在動いているもので、既定です。この項目を一度も開かないサーバーは、これまでとまったく同じように動き続けます。事実の単純な一覧で、最近更新されたものがすべての回答に注入され、自動で削除されるものはありません。

残りの5つは、それぞれ一つ前のタイプに1つずつ機能を加えたもので、順番に作られています。

  • ジャーナル - 今すぐ使えます。真でなくなった事実は消去されず、無効化されるので、以前の内容を読み返せます。次のセクションをご覧ください。
  • 検索可能なアーカイブ - 今すぐ使えます。botは渡された事実だけを使うのではなく、自分で調べられるので、注入の上限を超えた分も見えなくなりません。次の次のセクションをご覧ください。
  • ランク付きメモリ - 今すぐ使えます。枠は単に最新のものではなく、最も役立つ事実に割り当てられます。
  • 統合メモリ - 今すぐ使えます。サーバーが静かな間にバックグラウンドのパスが重複をまとめ、要約を書き直します。そのすべてが、あなたの承認用の提案として出されます。
  • セマンティックメモリ - 単語ではなく意味で照合します。たとえば*「フランス語を話す」が「サーバーの言語はフランス語」*に一致します。6つの中で最も強力で、費用がかかる唯一のタイプです。

まだ準備ができていない1つのタイプは、ダイアログ内で印が付いており、選べません。どのタイプでも、同じ2つのルールが成り立ちます。どれも同じメモリーを読むこと、そしてどれも自動では何も削除しないことです。そのため、気が変わって元に戻しても、事実を1つも失いません。

サーバーを1つ選ぶと、メモリーページは、変更する前に、何が動くことになるかを件数で教えてくれます。


📓 ジャーナル - 消すのではなく、無効化するだけ

ジャーナルでは、botは古くなったと判断した事実を削除しなくなります。その事実の有効期間が終わるだけです。AIに渡される文脈からは外れますが、このページには、有効でなくなった日付と、ある場合は代わりになった事実とともに残ります。

それに合わせた操作も加わります。botは[#12]を落とすだけでなく、*「これはもう正しくありません。代わりはこちらです」*と言えるようになり、古い文面が残ることもはっきり伝えられます。破壊的だと思っている訂正は、ためらいがちになるからです。

履歴を読む

何かが無効化されると、表の上に3つのタブが表示されます。

  • 有効 - botが実際に見られるもの。既定のタブで、*「botは何を知っているのか」*というページ本来の答えです。
  • 取り下げ済み - かつて正しかったこと。取り消し線付きで、日付、botが理由を述べた場合はその理由、そして代わりの事実が表示されます。
  • すべて - 両方を1つの一覧にしたもの。

間違った判断を元に戻す

botが間違えることもあります。無効化された行の復元は、ワンクリックでそれを再び有効にします。行を削除せずに残しているのは、そのためです。代わりの事実があっても、意図的にそのままにされます。2つの事実が同時に真であることもあり、どちらを残すかはパネルではなくあなたが決めることだからです。

削除は、無効化された行でも他の行と同じように、本当に削除します。人がこのページから事実を取り除くのは決断であり、それを再確認するものは何もありません。

切り替えと、元に戻すこと

ジャーナルをオンにしても、何も動きません。すでにある事実はすべて引き続き真とみなされ(もともとそうでした)、作成日もそのままです。

Classicに戻しても、その間に無効化されたものはそのまま残ります。このページにはあり、botには見えないままです。すべてをAIの前に戻したい場合は、メモリーページの取り下げた N 件をすべて復元で、そのサーバー1つ分をまとめて戻せ、監査ログにも記録されます。これが自動で行われることはありません。ジャーナルが無効化したものには、理由があって無効化されているからです。


🔎 検索可能なアーカイブ - botが自分で調べられる

Classicメモリーには、実際の限界が1つあります。保存できる事実の数ではありません。一度に注入する記憶事実の上限数を超えた分は、どれほど真実でも、AIには見えないということです。上限を上げるのが唯一の手段で、そうするとすべてのメッセージのコストが上がります。

検索可能なアーカイブは、botにもう1つの手段を与えます。最近の事実はこれまでどおり渡され、それに加えて、名前を指定して事実を求められます。たとえば*「メモリーを検索:Paulの誕生日」*のようにです。見つかったものは、答える前にbotに渡されます。

費用

botが何も調べないメッセージ、つまりほとんどのメッセージでは、費用はかかりません。調べるときは、AIへの呼び出しがちょうど1回増えるだけです。事実を手にした状態で、同じ質問をもう一度するためです。2回にはなりません。2回目の答えでもう一度検索を求めても、無視されます。

検索自体は、データベースが実行する全文検索です。埋め込みもベクトルも、メッセージごとの計算もなく、外部サービスも使いません。

届く範囲

そのサーバーの、まだ使われているすべての事実が対象で、サーバーに関する事実とメンバーに関する事実の両方のスコープを含みます。これは意図的なものです。*「Paulの誕生日」*は話している本人以外についての事実であり、話し手自身の事実にしか届かない検索では、聞く価値のある質問の大半を逃してしまいます。

届かないものは、ジャーナルで無効化されたものです。事実の有効期間を閉じるということは、それを返さないと決めることにほかなりません。また、メモリーの読み取りが許可されていないチャンネルにあるものも、一切届きません。検索は読み取りであり、同じメモリーの[読み取り]が許可されたチャンネルの設定に従います。

botが検索で見つけた事実は、渡された事実と同じ条件で、訂正することもできます。

切り替える前に:ドライラン

サーバーを1つ選ぶと、メモリーページが、あなた自身のデータから出した数字で、アーカイブにかかるコストを教えてくれます。インデックスを作る事実の数、そのテキストの量、そしてそれらに対して実際に検索を行うのにかかった時間です。

オンにしても、何も動かず、何も書き換わりません。インデックスは保存済みのテキストに対して作られ、検索するかどうかにかかわらずすべてのサーバーに用意されています。そのため、切り替えも元に戻すのも、どちらも一瞬です。


🏅 ランク付きメモリ - 枠は、それに値する事実へ

Classicメモリーは、最後に変更されたN件の事実をモデルに渡します。言い換えると、サーバーが1年守ってきたルールが、昨日の雑談に場所を奪われます。雑談のほうが最近触られたからです。

ランク付きメモリは、候補となるすべての事実を3つの観点で採点し、代わりに上位N件を渡します。

  • どれだけ新しいか。
  • どれだけ重要か - モデルが事実を書き込む瞬間に採点します。保存する理由がまだ目の前にあるのは、その瞬間だけだからです。
  • 今話していることとどれだけ関係があるか。

これはランキングであり、フィルターではありません。何かが永久に除外されることはなく、あるメッセージで選に漏れた事実も、次のメッセージでは再び候補になります。

重みはあなたが決めます

AI応答のページにある3つの設定(新しさ、重要度、関連性)が、それぞれの観点をどれだけ重視するかをサーバーごとに決めます。メモリーの大半が常設のルールであるサーバーは、新しさよりも重要度を重くしたくなるでしょうし、にぎやかな交流サーバーならその逆でしょう。

すべての事実に付いている信頼度も読まれます。これは乗数として働き、下げる方向にしか働きません。botが自信を持てなかった事実が、確信していた事実を上回ることはありません。

切り替えに費用はかかりません

移行も請求もありません。まだ誰も採点していない事実は、最下位ではなく真ん中に入るので、すでにあるものに対して最初のメッセージからランキングが機能し、botが事実を書き直すにつれて重要度は自然に埋まっていきます。

ドライランでは、あなたの事実のうちすでに点数が付いているものの数と、枠を得るものと失うものが表示されます。


🧩 統合メモリ - 整理はサーバーが静かな間に

メモリーが増えていくと、同じことを2つの名前で言うようになります。たとえば片方がlanguage、もう片方がlangのようにです。これまでは、手作業で対処するしかありませんでした。

統合メモリは、静かになったサーバーのメモリーに対してバックグラウンドのパスを追加します。回答の最中に実行されることはなく、そして重要なことですが、自分では何も適用しません。

提案するのはパス、決めるのはあなた

パスは提案を書き出します。提案はメモリーページに1件ずつ表示され、残す事実と、置き換えられる事実が並んで示されます。それぞれに3つの答えがあります。

  • 統合する - パスの提案を採用します。
  • 逆向きに統合する - 代わりにもう一方の事実を残します。食い違う2つの事実のうち、どちらがまだ正しいかを知っているのはあなたです。
  • 両方残す - 却下します。2つの事実のどちらかがあとで書き直されない限り、パスは二度と聞きません。

そのどれかをクリックするまで、何も変わりません。

承認しても消えない

統合は、ジャーナルの意味での置き換えです。脇に退く事実は、残った事実を指す形で有効期間を閉じ、このページに日付と理由付きで取り消し線で表示され、復元で戻せます。統合は、他の無効化とまったく同じように元に戻せます。

**矛盾する事実は決して統合されません。**正反対のことを言う2つの事実には、人が決着をつけるためのフラグが立てられます。パスには、どちらがまだ真なのかを知る手段がないからです。

要約が書き直される

要約は、botが毎回丸ごと読む唯一のメモリー行です。そのため、最初に古くなる行でもあります。書かれたのは、そのときに分かっていたことからだけです。

パスは、サーバー全体の事実から、今日ならどう書くかの下書きを作り、ページはその2つを並べて表示します。いまボットが読んでいる要約と、代わりに読むことになる要約です。統合と同じルールで、承認なしには何も置き換わらず、以前の文面は削除されずに無効化されます。

専用のモデル

このパスはDiscordへの返信と競うわけではないので、チャンネルで答えるモデルとは別の、より強力なモデルや安価なモデルで実行できます。パネルのすべてのモデル欄と同じように、専用のエンドポイントと専用のキーを使えます。

モデルなしでも動作します。モデルがなくても、パスはすべてのペアを見つけて提案します。統合では、2つを1つの文に書き直す代わりに、勝った事実が一字一句そのまま残ります。モデルが書くのは、提案される文面と要約の下書きだけです。

実行されるタイミング

パスは独自のスケジュールで動き、割に合わない場合は自分で実行を見送ります。重複が入るには小さすぎるメモリー、前回のパス以降に変化がない場合、前回から1日未満の場合、回答待ちの提案がすでにある場合です。静かになることのないサーバーでも、1週間後にはパスが実行されます。重複でメモリーがいっぱいになるのは、まさにそういうサーバーだからです。

切り替える前に:ドライラン

カードには、あなた自身のデータについて、保存されている事実の数、パスが見つける重複と矛盾の数、そしてサーバーから取った実際の例5件が表示されます。

オンにしても、何も動きません。最初のパスは提案するだけで、決めるのはあなたです。


🧠 セマンティックメモリ - 単語ではなく意味で

ここまでのすべてのタイプは、根本では同じ問いに答えています。*この2つのテキストは単語を共有しているか?というものです。「フランス語を話す」と「サーバーの言語はフランス語」*では、答えはノーです。共通する単語は1つで、しかも役に立つほうではありません。

セマンティックメモリは、各事実を埋め込み(文字列ではなく方向)に変えます。同じ意味を持つ2つの事実は、どんな言葉で書かれていても同じ方向を向き、その近さはパネルが比較できる数値になります。

実際に何が変わるか

変わるのは2つで、2つ目は毎日実感できるものです。

**検索の取りこぼしがなくなります。**botが渡されていない事実を探しに行くとき、メンバーが事実を書いた人と同じ単語を使っているかどうかに左右されなくなります。

**ランキングがメッセージの単語に左右されなくなります。**ランク付きでは、事実の関連性は検索結果のどこに入ったかで採点されます。セマンティックでは、いま話している内容にどれだけ実際に近いかで採点されます。*「この事実は見つかった」と「この事実はこの話題についてのものだ」*の違いです。

費用

これは、あなたのデータを定期的にどこかへ送る唯一のタイプなので、費用をはっきり述べておく価値があります。

  • 書き込まれた事実ごとに埋め込みの呼び出しが1回、一度だけ。言い回しが変わらない事実は、二度埋め込まれることはありません。
  • **ランキングの対象になる長さのメッセージごとに呼び出しが1回。**12文字未満のときは何も送られません。*「lol」*には照合するものがないからです。
  • 比較自体はデータベースではなくパネルで行われます。そのため、このタイプはサーバーあたり数千件の事実までなら快適ですが、それを大きく超えると厳しくなります。

埋め込みモデルが必要で、AI設定のほかの項目と同じエンドポイントとキーで名前を指定します。

自動でフォールバックします

モデルの指定がない、エンドポイントが拒否する、追いつきのパスがまだ実行されていない、または埋め込みモデルを変更したばかり、といったどの場合でも、検索は失敗せず、単語での照合に戻ります。回答には実際にどちらが動いたかが示されるので、黙ったフォールバックも見える状態に保たれます。

埋め込みモデルを変更すると、すべてが再び埋め込まれ、そのパスが終わるまでサーバーは単語で検索します。その間に壊れるものはありません。

切り替える前に:ドライラン

カードには、追いつきのパスが何回の呼び出しを行うか、どれだけのテキストに対してか、そしてあなたの事実のうちベクトルがすでに同じものとみなしているものが表示されます。

**通貨での価格は表示されません。**金額を載せるには、指定されたエンドポイントごとに料金表をでっち上げることになり、お金のページに作り話の数字を載せるのは、数字がないよりも悪いからです。


🧹 メモリーを消去する

エントリーを1件ずつ削除するのは、間違った事実が1つのときには適切です。それ以外の2つの場合には、サーバーを1つ選ぶとサーバーフィルターの隣にメモリーを消去が表示されます。

  • このサーバーのすべて - メモリーがずれすぎて、20件の訂正をするより最初からやり直したほうがよい場合。
  • 1人のメンバーに関するすべて - 誰かが抜けた、または忘れてほしいと頼まれた場合。そのDiscordユーザーIDを入力します。

実行はすぐに反映され、元に戻せません。botは次の会話からまた覚え始めます。消去はすべて、実行した人の名前で監査ログに記録され、削除された件数も残ります。


🔑 アクセス制御

メモリーのエントリーは、サーバーを所有するチームにアクセスできる人なら誰でも見られます。

変更は別の権利です。追加、編集、削除、消去のすべてに、サーバーを設定する権限が必要で、これは機能の設定に必要なものと同じです。それがなくても一覧は読めますが、メモリーを消去ボタンは表示されません。

機密のシークレット、パスワード、非公開のトークン、秘密情報をAIメモリーに保存しないでください。


🧵 スレッド

メモリーの読み取りと書き込みは、メモリーの[読み取り]が許可されたチャンネルとメモリーの[書き込み]が許可されたチャンネルの設定に従います。スレッドはそれらのチャンネルには含まれず、スレッドが開かれた元のチャンネルが含まれていても同じです。既定では、スレッドでメモリーの読み取りも書き込みも行われません。AI応答のスレッドを含めるオプション(既定ではオフ)をオンにすると、スレッドが開かれた元のチャンネルに従うようになります。詳しくはAI応答をご覧ください。スレッドが、メモリーの内容を見せたくない人にも開かれている可能性がある場合は、オフのままにしてください。


✨ メモリーと回答の質

メモリーは多ければよいというものではありません。

関係のない事実が多すぎると、AIの焦点がぼやけることがあります。

よいメモリーとは、次のようなものです。

  • 短い
  • 正確
  • 関連している
  • 最新
  • わかりやすい

💡 ベストプラクティス

  • サーバーに大きな変更があったら、メモリーを見直しましょう。
  • 古くなった事実は削除しましょう。
  • メンバーに忘れてほしいと頼まれたら、その人の行を探し回らずに、そのメンバーのエントリーを消去しましょう。
  • 重要なルールは、明確かつ具体的に保ちましょう。
  • 十分な理由と許可がない限り、ユーザーの個人データは保存しないでください。
  • メモリーは文脈を良くするために使い、モデレーションやスタッフの判断の代わりにしないでください。