AI 安全與開發平台
Claude 新模型將文字水印寫入生成過程,API 與 Claude Code 亦無例外
Anthropic 將為 2026 年 8 月 2 日後推出的 Claude 模型加入模型層文字水印,並為支援的檔案嵌入 C2PA 簽章來源資料。水印只能證明內容可能經 Claude 處理,不能證明作品由 AI 原創,公開偵測工具與實測準確率亦尚未公布。

Anthropic 公布新的生成內容標記方案:2026 年 8 月 2 日起推出的支援模型,會在文字生成階段織入人眼不可見的水印;標記位於文字本身,因此複製貼上後仍可能保留。措施在全球套用,涵蓋 Claude 應用程式、API、Claude Code 等介面,而不是只限制歐盟流量。PNG、JPEG、SVG 等支援格式則採另一條路徑,加入具數位簽章的 C2PA Content Credentials,記錄檔案曾由 Claude 處理。
這對工程團隊的影響不只在內容發布。API 回應若被寫入文件、程式碼註解、知識庫或訓練資料,可能攜帶同一訊號;資料管線因而需要保存模型版本、人工修改歷程與原始來源,不能把水印偵測結果直接當成作者身分或抄襲判定。Anthropic 明確承認,校對、翻譯、摘要或格式轉換也可能留下標記;相反地,短文、固定答案、節錄、重寫或跨語言轉換可能使訊號不足。因此「偵測到」只代表 Claude 可能參與處理,「未偵測到」也不能排除 AI。
Anthropic 尚未公開水印的演算法、偽陽性率、不同語言及程式碼上的可靠度,也未提供第三方可自行驗證的偵測器。相近的 SynthID 方法會微調候選 token 的抽樣機率,但不能據此斷定 Claude 採用相同設計。這次部署主要回應歐盟《AI 法案》第 50 條的機器可讀標記要求;接下來應關注舊模型的遷移時間、偵測 API 的存取條件,以及水印對低溫度解碼、結構化輸出與程式碼生成的實際影響。