模型與開發者平台
Claude Fable 5.1、長時間稼働するエージェントのキャッシュコストを削減する一方、アップグレードでは思考ブロックとツール呼び出しに破壊的変更
Anthropicは、100万tokenのコンテキストを備えたClaude Fable 5.1をリリースし、キャッシュ読み取り料金を75%引き下げるとともに、メッセージ単位の推論強度設定とツール間の進捗更新を追加した。既存のFable 5ワークフローでは単純にモデルを差し替えることはできず、ツール使用の強制、思考ブロックの再利用、セーフティルーティングはいずれも再テストが必要となる。

Anthropicは9月1日、長時間にわたるエージェント型ソフトウェア開発、科学研究、多段階の知識労働向けモデルとしてClaude Fable 5.1をリリースした。100万tokenのコンテキストと最大12万8,000 tokenの出力を提供し、API識別子は`claude-fable-5-1`。入力と出力の料金は100万token当たりそれぞれ10ドルと50ドルに据え置かれた一方、キャッシュ読み取りは0.25ドルに引き下げられ、Fable 5の4分の1となった。Anthropicは8月の実トラフィックに基づき、一般的なワークロードではコストが約25%、コンテキストとツールへの依存度が高いエージェントタスクでは最大約45%削減されると試算している。ただし、これはベンダーによる測定であり、プラットフォーム横断の独立評価ではない。
新版は、単なるモデルの置き換えではない。APIには、メッセージ単位の`effort`、現在のターンにのみ適用されるシステムメッセージ、ツール呼び出しの合間に人間が読める進捗を送信する`display: "updates"`が追加された。一方、移行ドキュメントには3つの破壊的な相違点が記載されている。特定のツールを必ず呼び出すよう要求する従来の方式は、そのままエラーになる可能性がある。旧モデルはFable 5.1のthinking blocksを読み取れない。また、過去の会話ターンを編集すると、既存の思考ブロックは無効になる。エージェントの完全な軌跡を保存するシステム、モデル間で処理を引き継ぐシステム、履歴をリプレイするシステムでは、特にバージョン境界を設ける必要がある。
Anthropicの自己評価によると、Fable 5.1はTerminal-Bench 4.0で55.8%を記録し、Fable 5の42.0%を上回った。Terminal-Bench-Science 0.1では52.6%だったが、この評価の標準誤差は±3.5~4.5パーセントポイントに達する。一部の安全性評価では、分類器の介入によってスコアが0点として計上されたり、別のClaudeモデルに処理が振り分けられたりするため、表を純粋なモデル能力の比較とみなすことはできない。
エンジニアリングチームは次の段階として、自社のツールチェーンを使って成功率、キャッシュヒット率、タスク当たりのコストを測定し、Fable自身による回答、フォールバックモデルによる回答、分類器による拒否を分けて記録すべきだ。Fable 5.1には、追加のデータ保持および安全性レビューに関するポリシーもデフォルトで適用される。AWSでも同時に提供が開始されたが、利用可能なリージョン、データガバナンス、ゼロデータ保持の適格性については、個別に確認する必要がある。