模型與開發工具
Claude Opus 5、調整可能な推論強度でFable 5に迫る――API価格は入力100万token当たり5ドルを維持
AnthropicはClaude Opus 5を発表した。Fable 5の半額の単価で、コーディングエージェントや企業向け業務を処理できる点を売りにする。GitHub Copilotでも同時に提供が始まったが、性能と安全性に関する評価は現時点で主にベンダーによるテストに基づいている。

Anthropicは7月24日、Claude Opus 5をリリースし、最上位のFable 5と、より軽量なモデルの中間に位置付けた。API価格は入力100万token当たり5ドル、出力100万token当たり25ドルで、Opus 4.8と同額、Fable 5の半額となる。開発者は「effort」も調整でき、同じモデルを使いながら、タスクに応じて推論の深さ、レイテンシ、token消費量のバランスを取れる。複数モデル向けのルーティングルールを別途維持するよりも直接的な方法だが、低いeffortでも複雑なタスクの品質を安定して維持できるかは、ワークロードごとに検証する必要がある。
GitHubはすでにOpus 5をCopilot Pro+、Max、Business、Enterpriseに追加しており、VS Code、JetBrains、CLI、クラウドエージェント、モバイルをカバーする。GitHubによると、初期テストでは自律的なコード変更、回帰検証、複数ツールの連携を重視し、必要な変更に集中しやすく、結果を検証し、不要な実行を減らす傾向が確認されたという。ただし、これらの説明には公開テストセット、完全な実行トレース、コスト分布が添えられておらず、独立したベンチマークとはみなせない。
安全性の面では、Opus 5は深刻な被害につながり得るサイバーセキュリティ関連コンテンツへの防御を強化しているため、正当な脆弱性調査やセキュリティに隣接するリクエストも遮断される可能性がある。エンジニアリングチームは問題の解決率を比較するだけでなく、回答拒否率、ツール呼び出し回数、エンドツーエンドの費用、長時間タスクの中断率も記録すべきだ。Fable 5は引き続き、最も複雑で長時間にわたる自律作業の第一候補と位置付けられている。そのため、Opus 5の真の価値は、単発のベンチマークスコアではなく、実際のエージェント実行トレースにおいて、より低い費用でFable 5に近い完了率を維持できるかどうかにかかっている。