模型發布
OpenAI 將 GPT-5.6 分成 Sol、Terra、Luna,統一百萬 token 上下文與代理工具介面
GPT-5.6 家族進入一般供應,以 Sol、Terra、Luna 分別覆蓋最高能力、均衡成本與大量低價工作負載。三款模型共享長上下文與工具介面,但推理成本、安全行為及實際品質仍需分別評估。
OpenAI 於 7 月 9 日把 GPT-5.6 家族推向一般供應,分為旗艦 Sol、均衡型 Terra 與成本導向的 Luna。官方資料顯示三款模型均接受文字與圖片,提供約 105 萬 token 上下文、最高 128K token 輸出,以及函式呼叫、網頁搜尋、檔案搜尋和電腦操作等工具。產品設計不再要求所有請求使用同一旗艦,而是讓系統按任務價值、延遲與推理深度路由。
對代理系統而言,最大的變化是長上下文與工具能力成為整個系列的共同介面。團隊可讓 Luna 處理分類、監控和簡短動作,Terra 負責一般程式與知識工作,只有高難度規劃才升級到 Sol。然而,一百萬 token 的標稱視窗不代表模型能平均利用每個位置;輸入越長,首 token 延遲、快取成本、檢索雜訊與錯誤工具呼叫也可能上升。三款模型雖可共用程式碼,提示詞和停止條件未必能原封不動移植。
開發者應建立以任務成功率與總成本為核心的路由評估,包括隱藏推理 token、重試、工具失敗和人工接管,而不是只比較每百萬 token 單價。早期獨立觀察仍有限,官方基準也可能受提示或測試設定影響。Sol 後續被捲入代理安全事件,更說明能力提升必須與網路隔離、權限最小化及行為預算一起評估;模型可用不等於適合直接取得生產憑證。