返回首頁

最新模型

Grok 4.7 強化長任務程式開發,API 自動回傳加密推理狀態

新版增加長時間任務訓練,並讓 Responses API 自動攜帶跨輪推理狀態。官方評測採用不同推理等級,API 與 Cursor 的長上下文計費門檻也須分別核對。

Earth Science and Remote Sensing Unit, Lyndon B. Johnson Space Center · Public domain · Image source
zh-Hant

SpaceXAI 於 9 月 21 日推出 Grok 4.7,開放 API、Cursor 與 Grok Build 使用。官方表示,新版採用更大的基礎模型,延長強化學習訓練,並增加需數小時完成的困難任務,著重持續執行、自我檢查與上下文管理。[官方公告](https://x.ai/news/grok-4-7)

官方表列的 CursorBench 4.0 成績由前版的 40.4% 升至 46.3%,但新版使用 xhigh、前版使用 high 推理等級,並非相同計算預算的對照。這些數字適合作為選型線索,仍需在自己的程式庫量測完成率、重試次數與整項任務成本。[評測設定](https://x.ai/news/grok-4-7)

推理等級共有四檔,預設為 high;提高等級會給模型更多時間處理困難任務。實務比較應固定工具權限、上下文裁切規則與時間上限,另外記錄額外思考是否減少錯誤,才能區分模型更新與推理預算各自帶來的效益。[推理設定](https://cursor.com/docs/models/grok-4-7)

API 接受文字與影像、輸出文字,上下文為 50 萬 token。整合上的具體變化是 Responses API 必定回傳加密推理欄位,即使請求未指定取得;多輪呼叫應將推理項目原樣放回下一次輸入。對自行保存對話的代理框架而言,工程重點因此包含序列化與狀態還原,不能只保存使用者可見的回答。[接入文件](https://docs.x.ai/developers/grok-4-7)

快取也會影響長任務成本。官方建議設定 `prompt_cache_key`,把同一對話導向相同伺服器,提高快取命中的穩定性;缺少此設定可能落到尚未建立快取的節點。部署者應把快取命中率與推理等級一起納入測試,避免只看標示的單價。[快取說明](https://docs.x.ai/developers/grok-4-7)

公開 API 的一般輸入、快取輸入及輸出,每百萬 token 分別為 2、0.5、6 美元;提示超過 20 萬 token 後改為 4、1、12 美元。Cursor 的長上下文門檻則是 25.6 萬,兩個入口的計費條件需要分開核對。Fast 版目前只在 Cursor 與 Grok Build 提供,公開 API 尚未開放。[API 更新紀錄](https://docs.x.ai/developers/release-notes)、[Cursor 規格](https://cursor.com/docs/models/grok-4-7)

技術上,這次更新讓長任務模型的能力、跨輪狀態及路由成本更緊密相連。對中文團隊,下一步應以繁體中文需求、既有測試與實際工具鏈重跑任務,確認摘要壓縮後能否保留限制條件,以及額外思考時間是否換得較少的人工作業。官方通用分數尚不足以回答這些部署問題。

來源

  1. Introducing Grok 4.7
  2. Grok 4.7 — API integration overview
  3. Release Notes — September 21: Grok 4.7
  4. Grok 4.7 — Cursor model specifications and pricing