AI 安全與開發平台
Claudeの新モデル、生成プロセスにテキスト透かしを組み込み——APIとClaude Codeも例外ではない
Anthropicは、2026年8月2日以降にリリースするClaudeモデルにモデル層のテキスト透かしを導入し、対応ファイルにはC2PA署名付きの来歴データを埋め込む。透かしが証明できるのは、コンテンツがClaudeによって処理された可能性に限られ、作品がAIによって新規生成されたことは証明できない。公開検出ツールや実測精度も、まだ公表されていない。

Anthropicは、新たな生成コンテンツのマーキング方式を発表した。2026年8月2日以降にリリースされる対応モデルは、テキスト生成時に人間の目には見えない透かしを組み込む。マーカーはテキスト自体に含まれるため、コピー&ペースト後も保持される可能性がある。この措置はEU圏のトラフィックだけに限定されず、世界全体に適用され、Claudeアプリ、API、Claude Codeなどのインターフェースが対象となる。PNG、JPEG、SVGなどの対応形式には別の手法を採用し、デジタル署名付きのC2PA Content Credentialsを付与して、ファイルがClaudeによって処理された履歴を記録する。
エンジニアリングチームへの影響は、コンテンツ公開だけにとどまらない。APIレスポンスが文書、コードコメント、ナレッジベース、または学習データに書き込まれた場合、同じシグナルを伴う可能性がある。そのため、データパイプラインではモデルのバージョン、人手による編集履歴、一次ソースを保存する必要があり、透かしの検出結果を作者の特定や盗用の判定に直接用いてはならない。Anthropicは、校正、翻訳、要約、フォーマット変換でもマーカーが残る可能性があると明確に認めている。一方で、短文、定型回答、抜粋、リライト、言語間変換ではシグナルが不十分になる可能性がある。したがって、「検出された」という結果が意味するのはClaudeが処理に関与した可能性にすぎず、「検出されなかった」場合もAIの関与を排除できない。
Anthropicは、透かしのアルゴリズム、偽陽性率、言語別およびコードにおける信頼性をまだ公表しておらず、第三者が独自に検証できる検出器も提供していない。類似するSynthIDの手法では、候補tokenのサンプリング確率を微調整するが、それを根拠にClaudeが同じ設計を採用していると断定することはできない。今回の展開は主に、EUの「AI Act」第50条が定める機械可読マーキング要件への対応である。今後は、旧モデルの移行時期、検出APIへのアクセス条件、そして低temperature decoding、structured output、コード生成に対する透かしの実際の影響に注目すべきだ。