代理記憶研究
TEPA 撤銷過期代理記憶,反轉任務成功率由 21.0% 升至 95.0%
TEPA 為長期記憶加入可撤銷的有效狀態,讓被新證據推翻的內容退出一般檢索但保留稽核紀錄。方法能修復單跳衝突,遇到多跳或 262K 長上下文時卻幾乎失效。

代理記憶通常只回答「這段內容是否相關」,TEPA 則要求系統同時判斷「它是否仍然有效」。研究團隊把觀察資料寫成帶有衝突鍵、證據、狀態與矛盾歷史的 precedent;相同鍵出現足夠反證時,舊項目由 active 轉為 revoked,不再進入普通檢索,但仍保存在封存區,供稽核或日後重新啟用。完整版還以支援、反事實與污染檢查驗證候選更新,避免一次錯誤工具結果直接覆蓋長期知識。
在每個種子含 160 項任務、共 50 個種子的隱藏規則反轉實驗中,append-only 與 last-write-wins 在完全反轉階段都只有 0.210 成功率,甚至低於無記憶的 0.309;TEPA 達 0.950。使用真實檔案讀寫與工具執行時,前三者分別為 0.203、0.203、0.298,TEPA 仍為 0.950。移除撤銷機制後,成績降至 0.211,顯示主要增益確實來自讓過期 precedent 離開 active set,而非單純增加提示內容。
外部 MemoryAgentBench SH-6k 測試較保守:TEPA 的 substring exact match 為 0.890,只與直接按鍵保留最新值的快取持平。方法在 SH-32k 降至 0.680,在 MH-6k 僅 0.040,SH-262k 更為零;它解決的是單一事實的生命週期,不是多跳鏈建構或超長上下文選擇。另一限制是實驗使用結構化衝突鍵;當鍵加入 20% 雜訊,反轉成功率降至 0.777。對生產系統而言,值得採用的觀念是把 validity 與 relevance 分開儲存,但在開放式記憶中如何可靠抽取衝突鍵,以及論文未提供獨立實作儲存庫,仍是重現前必須處理的問題。