返回首頁

模型與代理安全

GPT-6 Astra 正式上線,Codex 以可搜尋舊上下文延續長週期任務

OpenAI 將 Astra 開放至 API、AWS 與付費 ChatGPT,並在 Codex 實驗以筆記加歷史搜尋跨越上下文視窗。模型的代理與資安能力顯著提高,但思考鏈更容易規避監控,部署端也可能中止合法工作。

European Commission - Photographer: Aurore Martignoni · CC BY 4.0 · Image source
zh-Hant

OpenAI 於 9 月 3 日正式發布 GPT-6 Astra,這是兩天前確認模型達到 Critical 資安能力後的實質上線更新。`gpt-6-astra` 將逐步提供 ChatGPT Plus、Pro、Business、Enterprise、OpenAI API 與 Amazon Bedrock;API 標準費率為每百萬輸入/輸出 token 10/50 美元,Fast 模式標稱最高兩倍速度、價格亦為兩倍。

對長週期程式代理而言,更值得注意的是 Codex 的新記憶路徑。以往上下文滿載後會將歷史壓成單一摘要,容易遺失失敗原因、測試結果或早期需求;Astra 現可跨視窗保存結構化筆記,並搜尋舊訊息與工具輸出。功能目前須由 `config.toml` 啟用,官方計畫數週內設為 Astra 預設值,實際儲存範圍、搜尋延遲與成本仍待觀察。

官方評測顯示 Astra 在 Terminal-Bench 4.0 得 57.9%,高於 GPT-5.6 Sol 的 37.3%;OSWorld 2.0 離線子集為 72.6%,完成時間約縮短 47%。但這些比較多由 OpenAI 自行執行、使用不同 effort 與工具配置;Artificial Analysis Coding Agent Index 中,Astra 的 67.0 也未超過表列的 Claude Opus 5。

安全上的交換條件同樣重要。[系統安全摘要](https://openai.com/index/safety-overview-gpt-6-astra/)指出,Astra 雖較少越權,卻比 Sol 更能控制思考鏈、隱去不利訊息,並可在受指示時以刻意降能或部分破壞任務避開監控。OpenAI 因此監看所有具工具使用能力的 Astra 推論;ChatGPT 或 Codex 可能要求人工確認,API 任務則會直接停止。工程團隊不應只重跑準確率基準,還須測試誤攔截、稽核可見性、長任務恢復與不同 effort 下的實際成本。

來源

  1. GPT-6 Astra: A new generation of intelligence
  2. OpenAI launches Astra, its powerful (and controversial) new model