研究ノート¶
翻訳について: 正本は英語版です。日本語版が古い場合は英語版を参照してください。
設計ページは、サーバーが何を建て、なぜそうするかを述べます。これらのノートは、その 設計ページが拠って立つもの (導出・実測・反証) を、読み手が信じるのではなく検算できる 形で書いて収めたものです。
設計ページはノートを引用しますが、ノートが設計ページを上書きすることは決してありま せん。ノートと設計ページが食い違う場合、設計ページが誤っているか、ノートが古いかの どちらかであり、その食い違い自体が発見です。
どのノートも、次の語彙から選んだ status 行で始まります。
| Status | 意味 |
|---|---|
| derivation (導出) | 明示した仮定から従う結果。各仮定は、それを反証することになる観測を名指しする。測るまでは挙動ではない。 |
| measurement (実測) | 名指しした計器で、名指しした条件の下に取った数値と、それを生んだコマンド。事前登録した主張を持たない実測は、そう明記する。 |
| refuted (反証済み) | 後の実測が否定した導出または主張。反証こそが有用な部分なので残してある。 |
| superseded (差し替え済み) | 後のノートに置き換えられたもの。そのノートへのリンクを持つ。 |
この節にあるものは、何一つ出荷済みの保証ではありません。ある挙動が保証になるのは、 リリースライフサイクルを通った時だけです。
ノート¶
| ノート | Status | 一行で |
|---|---|---|
| 適応的融合の導出 | derivation | 各検索アームを、それぞれの null に対する超過確率を通して結合する Bayes 最適な方法。行ごとの影響度が閉じた形で出る混合則で、その極限は現行の reciprocal rank fusion に厳密に一致する。実装に先立って済ませなければならない実測。 |
| 較正は字面アームの損失の原因か? | measurement | 3 つの較正法、2 回の反復、負けている 7 タスク: admission floor は原因ではない、null は誤ったペア母集団から取られていた、小コーパスは dense アームを飢餓させる。 |
| 損失はどこにあるか — 凍結段リプレイ | measurement | Track B 経路のすべての段を凍結した埋め込みと字面スコアの上で採点し、3 モデル、稼働中の pipeline に固定: 純 ranking の損失は融合段であり、lexical の票で持ち上げられた dense 行から成る。Gorilla の損失は admission、EPBench の損失はプールサイズ gate、QASPER の正の融合差は補充。 |
| 2 本のアーム、1 つの決定 | derivation | アームごとのスコアと null 超過確率しか見ない規則は、lexical の証拠が dense の証拠を上書きすべき時を決められない。決める量は dense スコアで条件付けた lexical の証拠。参照パネル上の同時密度比が、重みを当てはめずにそれを供給する。飢餓、gate の全滅、予約不変条件の閉形式。 |
ノートの書き方¶
- 仮定が先、それぞれに反証を添える。 何が自分を誤りと示すかを言えない導出は、 導出ではありません。
- 数値は計器を伴う。 モデル、キャッシュ、フラグ、コミット、そしてコマンドです。 読み手が再生成できない表は、実測ではなく主張です。
- 訂正は見える場所に残す。 後の検査が数値を締めた時 (丸めた「±0.1」が実は 0.21 だった、「0%」が実は 2 クエリだった)、そのまま置き換えるのではなく、ノートがそう 述べます。
- 内部ポインタを書かない。 ノートは自分の理由を全文で説明します。このサイトの 読み手が開けないものを参照しません。