返回首頁

最新模型

GPT-6 Sol、Luna 上線,降低 token 單價並擴充代理快取控制

Sol 的標準輸入與輸出單價較前代促銷價減半,Luna 也同步降價。快取更新讓代理調整推理與工具使用時保留前綴,但寫入費率及任務重試仍影響總成本。

OpenAI ChatGPT (GPT-5.6 Sol), using OpenAI image generation · Public domain · Image source
zh-Hant

OpenAI 於 9 月 22 日推出 GPT-6 Sol 與 Luna,API 名稱為 `gpt-6-sol`、`gpt-6-luna`。每百萬 token 的標準輸入/輸出價格,Sol 為 2/10 美元,Luna 為 0.10/0.50 美元;Sol 兩項單價均為前代促銷價的一半。對多輪程式代理而言,新版的部署重點還包括同步公布的快取控制。[模型公告](https://openai.com/index/introducing-gpt-6-sol-and-luna/)

提示快取保存共同前綴的鍵值狀態,減少反覆處理指令、工具定義與歷史訊息。新公告提供快取儀表板、未命中診斷及明確斷點,讓開發者指定可重用內容的終點;官方表示,合格前綴可在三十分鐘視窗內享有快取折扣。這讓快取表現能被量測,也讓頻繁變動的內容與穩定前綴有不同處理方式。[快取公告](https://openai.com/index/better-prompt-caching-for-gpt-6/)

介面使用有關鍵條件:要在後續回應提高推理強度,須追加 `configuration_update`,並維持請求頂層的推理設定;直接改寫頂層值仍可能改變前綴。工具則應保留定義、順序與結構,以 `allowed_tools` 控制可呼叫範圍。文件同時列出快取寫入按標準輸入價的 1.25 倍計費、讀取為 0.1 倍,因此「讀取便宜九成」不能套用到整張帳單。可快取前綴至少須有 1,024 個可見輸入 token;若選擇只用明確斷點,卻沒有放置任何斷點,請求便不會建立或使用快取。[API 文件](https://developers.openai.com/api/docs/guides/prompt-caching)

推理預算仍會改變單次任務成本。Artificial Analysis 的 Sol 比較頁列出,high 與 max 的綜合指數分別為 43、48,每題加權平均成本為 0.37、1.06 美元。這是該評測組合下的結果,不能直接視為企業程式庫的修復成功率;工程團隊仍須用相同代理框架、測試集與重試規則評估。[實測比較](https://artificialanalysis.ai/models/comparisons/gpt-6-sol-high-vs-gpt-6-sol)

GitHub 同日宣布兩款模型進入 Copilot,採逐步開放與用量計費。實務上,開發者應分別量測快取命中率、首個答案延遲、總 token 與任務通過率,再決定何時提高推理強度。模型單價下降提供了更大的試驗空間,實際節省幅度仍取決於上下文能否重用,以及失敗後需要多少額外回合。涉及繁體中文文件的流程,也應另外檢查檢索引用、工具參數與最終答案,避免只用英文程式評測決定模型路由。[GitHub 公告](https://github.blog/changelog/2026-09-22-openais-gpt-6-sol-and-gpt-6-luna-now-available/)

來源

  1. Prompt caching
  2. GPT-6 Sol (high) vs GPT-6 Sol (max)
  3. OpenAI’s GPT-6 Sol and GPT-6 Luna now available