AI 安全與網路攻防
OpenAI 限定釋出 GPT‑5.6‑Cyber:高風險請求完成率由 1.5% 升至 95%
OpenAI 把專門降低網攻研究拒答率的 GPT‑5.6‑Cyber 放進需審核的 Daybreak Red,而非一般 API。公司評估其網攻能力屬 High、未達 Critical,但完整 system card 尚待發布。

OpenAI 於 8 月 10 日擴充 Daybreak,將資安模型存取分成 Blue 與 Red。Blue 向核准的防禦者提供 GPT‑5.6 Sol,移除部分系統層攔截;Red 才提供以 GPT‑5.6 Sol 為基礎、針對零日漏洞搜尋、漏洞鏈開發及利用驗證再訓練的 GPT‑5.6‑Cyber。這是日前 Astra 開發因無法排除 Critical 網攻能力而暫停後的實質後續:新模型完成評估並受限部署,但沒有進入一般模型目錄。
最醒目的數字來自 OpenAI 內部的 Advanced Cybersecurity Completion Rate。測試涵蓋驗證繞過、權限提升與漏洞鏈等雙重用途要求;GPT‑5.6‑Cyber 回應其中 95.0%,GPT‑5.6 Sol 僅 1.5%,Daybreak Blue 狀態為 2.0%,前代 GPT‑5.5‑Cyber 則為 57.3%。這個指標量的是是否完成高風險請求,不等於漏洞或利用程式正確率,也可能伴隨更高 token 消耗。
能力提升並不一致。OpenAI 稱新模型在 ExploitGym 與內部零日資料集優於比較模型,但在漏洞發現與報告撰寫評測反而輸給 GPT‑5.6 Sol,原因可能是報告較短;ExploitBench 的 300 輪標準設定也由 Sol 取得最佳結果。公司同時披露模型曾找到可串聯的兩個 V8 問題,其中 CVE-2026-15903 已由 Chrome 150.0.7871.128 修補。Chrome 公告確認該越界讀寫問題由 OpenAI Codex Security 回報,NVD 記錄的 CISA-ADP 分數為 8.8。
OpenAI 將模型定為網攻能力 High、未達 Critical,並以身分驗證、硬體安全金鑰、使用監控及法律聲明限制 Red 存取。對防禦團隊而言,重要改變是模型可以處理過去被拒絕的真實利用研究;但內部基準、尚未公開的 system card,以及模型對未知沙箱與長時間代理行為的表現,仍是部署前必須等待或自行驗證的部分。