AI 基礎設施
Exa Snapshot 固定歷史網頁內容供代理評測,搜尋排序仍採當前訊號
Exa 推出歷史網頁內容查詢,讓代理在指定時間界線內取得證據,降低後來公開答案造成的評測污染。功能仍屬研究預覽,公開方案的歷史範圍與搜尋模式均有限制。

Exa 於9月17日公布 Snapshot 研究預覽,讓代理以指定時間以前儲存的網頁版本進行搜尋與內容擷取。它瞄準的是評測與強化學習中的網路答案外洩:即使題目較早建立,稍後上網執行的代理仍可能找到已公開的解答,讓評分混入搜尋捷徑。[官方公告](https://exa.ai/blog/exa-snapshot)
介面沿用 `/search` 與 `/contents`。前者把 `snapshotAsOf` 放在 `contents` 內,後者放在請求最上層;服務選取截止時間當下或之前最新的儲存版本。找不到合格版本的網址會被省略,內容擷取的狀態欄則回報 `CONTENT_NOT_CACHED`,不能將缺頁直接解讀成當年不存在該資訊。[API 文件](https://exa.ai/docs/search/snapshot)
但時間界線只約束內容。Exa 仍用目前的檢索訊號尋找候選網址,再篩掉沒有合格歷史版本的頁面;官方在 GitHub 維護的介接文件也明確區分內容截止與排序。因此,Snapshot 能提供較早的證據,卻無法完整重建當年搜尋引擎會找到或優先排列哪些網站。[官方介接文件](https://github.com/exa-labs/agent-skills/blob/main/skills/build-with-exa/references/search.md)
可用資料範圍也需要分清。公告稱底層涵蓋超過四千億份、橫跨二十年的網頁快照,但公開隨用隨付方案文件列出的查詢範圍是滾動五個月、每秒十次請求,超過一百次需聯絡業務。歷史存量並不等於所有帳戶都能直接查詢的範圍。[公告](https://exa.ai/blog/exa-snapshot)、[存取限制](https://exa.ai/docs/search/snapshot)
對訓練平台而言,接入時還得調整工具參數:Snapshot 不接受即時爬取、快取年齡或子頁展開選項,搜尋僅支援 `auto`、`fast` 與 `instant`,不支援深度搜尋模式及 `category`。沿用原有搜尋工具的預設參數,可能直接收到無效請求錯誤。[相容性規則](https://exa.ai/docs/search/snapshot)
從評測設計推論,固定內容時間能降低後來網頁更新造成的污染,但模型權重原本記住的答案、其他工具的即時連線,以及目前排序帶來的選擇偏差,仍須另外控制。研究者應保存實際回傳內容與缺頁率,檢查不同語言及網站的歷史覆蓋;公告及上述文件未附量化整體洩漏降低幅度的基準。若要比較兩次實驗,還需固定查詢、模型版本與工具路徑,單靠截止日期不足以保證整條代理流程可重現。