コンテンツにスキップ

Memory Intelligence — 2.7 系

翻訳について: 正本は英語版です。この日本語版は参照用の翻訳で、内容が食い違う場合は英語版が優先されます。

Status: 設計であって、挙動ではない。本ページは 2.7 系が何を建て、なぜそうするかの正本 です。ここにあるものは何一つ出荷済みの保証ではなく、測定されたものもまだありません。 ある節が挙動になるのは、実装され、behaviour golden で固定され、 ライフサイクル標準 を通して出荷された時だけです。 設計の問いが決まっていない箇所は、計画で埋めずに 未決定 と書いてあります。本ページと リリース済みのツール記述が食い違う場合、正しいのはリリースで、食い違いは本ページの 欠陥です。

各節は単独で読み、引用し、注入できるように書いてあります。2.7 がラインの中でどこに 位置するかは ロードマップ が、2.7 が何であるかは本ページが述べます。

0. なぜこのラインがあるのか

2.6 系は 何が返ってくるか を変えるラインです。想起を 1 回の呼び出しの中の有界な プロセスにし、そのプロセスは手がかりを追います — 時刻、episode、出所、宣言された 関係、溢れ分の連鎖 (Reliable Recall)。

これらの手がかりが答えるのは、どれも 記憶がどこにあるか です。その記憶を どれだけ信用してよいか、今も有効か、後から訂正されていないか には、どれも 答えません。今日のサーバーは、この 3 つのどれも言えません。2.7 はその信号を与える ラインです。

記憶は見つかっただけでは使えない。いつの状態として、どれだけ確かなものとして、何に 置き換えられたものとして返るのかを、サーバーが決定論的に示せなければならない。

どのラインでも変わらない 5 つは ロードマップ に一度だけ 書いてあり、ここでは前提です。その 1 つ目がこのライン全体の形を決めます。サーバーは モデルを呼びません。したがって 意味の判断はエージェントが主張し、サーバーはそれを 保存し、問い合わせ、整合性を検査します。サーバーが 2 つの文章を読んで矛盾を見つける ことはしません。

1. 5 つの項目と、1 つの拡張

# 項目 答える問い 2.6 から継ぐもの
1 訂正と矛盾の扱い この記憶は、後から直されたり、別の記憶と食い違ったりしていないか 宣言された関係の役割語彙 (supersedes、corrects、contradicts、qualifies)
2 時間状態と履歴 この記憶は「いつの時点の事実」で、今も有効か Cued Recall の時間の手がかり、prior 関数、timestamp の正規化
3 証拠で重み付けした確信度 この記憶をどれだけ信用してよいか、その根拠は何か 再構成想起の claims と独立性判定、opt-in の confidence スコアラー
4 忘却と保持の方針 何を残し、何を想起から退かせ、何を消すか lock、削除、解決済みフラグ、agent / project / channel の分離
5 想起が何に使われたかのフィードバック 返した記憶は役に立ったか recall trace、再構成窓
拡張 コーパスが育つ中での品質劣化の制御 件数が増えた時に、品質曲線はどこで折れるか スケールの階段と、規模別の測定

拡張項目は、このラインでは 測定だけ を行います。制御の設計は、測定が出てから 開きます。

依存の順

1 訂正と矛盾 ──┐
               ├─→ 3 確信度 ──→ 4 忘却と保持
2 時間状態 ────┘                     ↑
5 フィードバック ────────────────────┘

1 と 2 は独立に着手できます。3 は 1 と 2 を入力に使います (訂正された記憶、有効期間の 切れた記憶は確かさが下がる)。4 は 3 と 5 を入力に使います (信用が低く、使われていない ものから退かせる)。5 は入力側が独立なので、1・2 と並行できます。

2. 各項目の設計の問い

各項目は同じ形で書きます。何が問題か、サーバーが受け取るもの、サーバーがすること、 想起プロセスの中での役割、変えないもの、測り方、そしてまだ決まっていないこと。

2.1 訂正と矛盾の扱い

問題。 記憶は改められます。その場での更新は履歴を残しません。そして 別の レコードが前のレコードを訂正している場合 — 「A は X だ」の後に「A は Y だった、X は 誤り」— 両方が同じ強さで返ります。

受け取るもの。 エージェントが宣言する record → record の関係 (corrects、 supersedes、contradicts、qualifies)。語彙は 2.6 の連想記憶が既に受理しています。

サーバーがすること。

  • 既定では訂正した側を返し、それ以前の版があることを示す印と、その版の ref を 付けます。訂正された側の本文は、明示的に求められた時だけ返します。隠されるものは ありません (ref は常にあります)。ただし古い内容が、現在の事実のような顔で届くことは ありません。
  • 解決されていない contradicts の組は、どちらかを黙って選ばずに、矛盾として印を 付けて返します。
  • 宣言の整合性を検査します。循環する supersedes、自己参照、分離境界をまたぐ関係。

想起プロセスの中で。 訂正の辺は手がかりです。ループが古い側にヒットしたら、索引に 戻らずに辺をたどって新しい側へ進みます。

変えないもの。 保存された行は書き換えません。訂正された記憶は消えず、履歴として 残ります。

測り方。 訂正を含む質問群で、訂正前の内容を現在の事実として返した率。事前登録 します。

未決定。 未解決の矛盾を検出するのは宣言された組だけか、それとも同じエンティティ・ 同じ述語で目的語が異なる関係も、機械的に候補として挙げるか (列挙するだけで、判断は しない)。

2.2 時間状態と履歴

問題。 記憶の timestamp は「いつ書かれたか」を示します。「いつの事実か」 「いつまで有効か」は示しません。去年の住所と今年の住所はどちらも真で、有効な期間が 違います。

受け取るもの。 エージェントが主張する有効期間 (valid_from / valid_to、どちらも 省略可)。以前の計画はモデルに文章から日付を抽出させていましたが、モデルを呼ばない 規則の下では、期間はエージェントが主張します。

サーバーがすること。 このラインは bi-temporal モデルを丸ごと引き受けます。時間の軸は 2 つ — 事実が成り立っていた時間 (主張される) と、サーバーがそれを記録した時間 (既に 保存されている) です。

  • 期間を保存し、「この時点で有効だったもの」に答えます。
  • 記録の軸でも答えます — 「その時点のサーバーは、この時点について何を持っていたか」。 後からの訂正が、それ以前に知られていたことを消さないようにするためです。
  • 有効期間が切れた記憶は、現在の事実としてではなく、過去の状態として返します。
  • 同じ対象の状態の連なりを、時間順の履歴として再構成の出口で束ねます。

想起プロセスの中で。 Cued Recall の時間の手がかりが、書かれた時刻だけでなく 有効期間にも当たるようになります。

変えないもの。 期間の無い記憶は、今日と byte 単位で同じに振る舞います (progressive enhancement)。スキーマの変更は追加のみです。

測り方。 時間を問う質問型 (いつ / その時点で / 今は) での evidence recall と、過去の 状態を現在として返した率。

未決定。 期間を持つのは関係 (辺) だけか、記憶の行そのものもか。

2.3 証拠で重み付けした確信度

問題。 今日ある confidence スコアは、類似度・時間減衰・解決済みフラグ・想起回数から 作る opt-in のスコアラーです。有効にすると融合後のリスト全体を並べ替えるので、2.6 は その段を外すか融合の 1 項にするかを決めます (その決定)。どちらに決まっても、この値が 示すのは行が 問い にどれだけ合うかです。記憶 がどれだけ確かかではありません。

受け取るもの。 (a) 書き込み時にエージェントが付ける確度。3 値の列挙です — 2.6 の 時間の手がかりが列挙を使うのと同じ理由で、float はエージェントの間で較正されません。 (b) 項目 1 と 2 が作る信号。

サーバーがすること。 記憶ごとの確信度を、独立な裏付けの数、訂正・矛盾の状態、 有効期間、出所の種別から決定論的に組み立て、根拠の内訳と一緒に 返します。数字 だけを返すことはしません。

想起プロセスの中で。 証拠が十分かどうかの判定に入ります。止まるか続けるかを 決める時、ループは確かな 1 件と不確かな 3 件を区別できます。

変えないもの。 確信度は結果の順序を変えません。関連度と確信度は別の 2 つの値として 返り、順位は関連度の順位のままです。

測り方。 較正 — サーバーが確かだと言った記憶が実際に正しい率が、不確かだと言った 記憶より高いか。

未決定。 「独立な裏付け」の定義 (別の episode か、別の出所か、別の日か)。再構成 想起の独立性判定をそのまま使うか。

2.4 忘却と保持の方針

問題。 今日あるのは削除と lock です。「残すが、想起からは退かせる」がありません。 件数が増えると、古く、訂正済みで、使われていない記憶が候補プールを占めます。

受け取るもの。 利用者またはエージェントが宣言する保持方針 (分離の単位ごと)。

サーバーがすること。

  • 退かせる (想起の候補から外すが、求めれば取れる) と 消す を、別の操作にします。
  • 方針に該当する記憶を 列挙して 提示します。方針の適用は別の、明示的な操作です。 観測する側と変更する側を分けます。
  • lock された記憶は、どの方針の対象にもなりません。

想起プロセスの中で。 退いた記憶は near リストに入りません。窓を広げた時にだけ、 far の候補として届きます。

変えないもの。 どの設定でも、サーバーが自分の判断で記憶を消すことはありません。

測り方。 方針の適用前後での evidence recall (落ちないこと) と、候補プールの大きさ・ 遅延 (下がること)。

未決定。 退かせた状態を新しい列で持つか、既存フィールドの値で持つか。既定の方針を サーバーに同梱するか、方針は常に利用者が書くか。

2.5 想起が何に使われたかのフィードバック

問題。 サーバーは何を返したかを知っています。それが使われたかは知りません。品質の 改善は今、ベンチマークの上でしか回りません。

受け取るもの。 エージェントが返す recall 単位の申告 — 使った、使わなかった、 誤りだった — で、対象は ref で指定します。

サーバーがすること。 申告を保存し、recall trace と結び、(a) 項目 4 の入力に使い、 (b) 失敗の分類を機械的に付け、(c) 集計を診断として出します。このラインでは、申告が ランキングを自動的に変えることはありません。 サーバーが自分の出力で自分を強化する ループは、申告の信頼性を測る前には入れません。

想起プロセスの中で。 直接は入りません。入るのは項目 4 と、後のラインを通してです。

変えないもの。 申告が無ければ何も変わりません。申告の中身 (生のクエリや記憶の 本文) がインストールの外へ出ることはありません。

測り方。 申告と、独立に採点した正否の一致。申告が信用できない場合、この項目は 不採用 として記録します。

未決定。 申告の語彙 (3 値で足りるか)。申告を書き込みとして数えるか — 数えるなら、 保存を止めたセッションでは記録されません。

3. 「完了」の意味

各項目は 2 層で閉じます。

  • 完了: 設計が本ページにあり、実装され、behaviour golden で固定され、ロジックを 壊した時にテストが落ちることを変異で示している。
  • 採否: 事前に登録した判定則に対して効果を測り、3 つの結果のどれかを記録している — 既定にする、opt-in に留める、不採用。不採用 も、他と同じく結果として公開します。

5 項目すべてが完了し、それぞれに採否の記録があることが、このラインの完了です。拡張 項目が求めるのは、規模別の測定が公開されていることだけです。

4. このページが決めないこと

  • 有界な修復 — 承認された修復を適用して再監査する conformer。修復を囲む方針・権限・ ロールバックの境界と一体のもので、それは 2.8 の候補 の主題です。設計はまだありません。
  • この後のラインが、これらの信号をどう使うか。
  • 既定値。 どの項目も、採否を測る前に既定を変えることはしません。
  • 版番号と日付。 2.7 がラインの中でどこに位置するかは ロードマップ が、 何が出荷されたかはリリースノートが述べます。