返回首頁

模型與開發者平台

Claude Fable 5.1 降低長代理快取成本,但升級涉及思考區塊與工具呼叫破壞性變更

Anthropic 推出具 100 萬 token 上下文的 Claude Fable 5.1,將快取讀取價格降低 75%,並加入逐訊息推理力度與工具間進度更新。既有 Fable 5 工作流程不能直接換模型,強制工具使用、思考區塊重用及安全路由都需要重新測試。

Прикли · CC0 · Image source
zh-Hant

Anthropic 於 9 月 1 日推出 Claude Fable 5.1,定位在長時間代理式程式開發、科學研究及多階段知識工作。模型提供 100 萬 token 上下文與最高 12.8 萬 token 輸出,API 識別碼為 `claude-fable-5-1`;輸入、輸出價格維持每百萬 token 10 美元與 50 美元,但快取讀取降至 0.25 美元,僅為 Fable 5 的四分之一。Anthropic 依八月實際流量估算,一般工作負載成本可下降約 25%,高度依賴上下文與工具的代理任務最多約 45%,惟這仍是供應商測量而非跨平台獨立評測。

新版不只是模型替換。API 新增逐訊息 `effort`、只作用於當前回合的系統訊息,以及在工具呼叫之間傳送可讀進度的 `display: "updates"`。另一方面,遷移文件列出三項破壞性差異:要求特定工具必須被呼叫的舊模式可能直接回錯;較早模型不能讀取 Fable 5.1 的 thinking blocks;編輯較早對話回合後,既有思考區塊會失效。保存完整代理軌跡、跨模型接手或重播歷史的系統尤其需要建立版本邊界。

Anthropic 自評顯示,Fable 5.1 在 Terminal-Bench 4.0 得到 55.8%,高於 Fable 5 的 42.0%;Terminal-Bench-Science 0.1 則為 52.6%,但該項標準誤達 ±3.5 至 4.5 個百分點。部分安全評測還會因分類器介入而計零分或改由其他 Claude 模型處理,不能把表格視為純模型能力比較。

工程團隊下一步應以自身工具鏈測量成功率、快取命中率和每任務成本,並分開記錄 Fable 實際作答、回退模型作答及分類器拒絕。Fable 5.1 亦預設受額外資料保留與安全審查政策約束;AWS 雖已同步供應,但區域、資料治理與零保留資格仍須逐一確認。

來源

  1. Introducing Claude Fable 5.1 and Claude Mythos 5.1
  2. Claude Fable 5.1 model overview
  3. Claude Fable 5.1 is now available on AWS