Anthropic 簽署歐盟 AI 法案實踐準則,宣佈自 2026 年 8 月起所有新發布的 Claude 模型將在全球範圍內嵌入內容標識。該要求不僅限於歐盟市場,而是覆蓋包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag 在內的所有 Claude 產品線。現有模型將獲得法律過渡期,但 Anthropic 表示已在推進水印功能的回溯適配工作。

Anthropic 採用兩種標識機制:文本輸出將攜帶不影響內容含義和可讀性的隱形水印,該水印在複製粘貼後依然存在,並"可能在一定程度編輯後保留"。圖像等文件格式將基於 C2PA 開放標準附加數字簽名溯源元數據,簽名可表明文件經過 Claude 處理並能揭示後續篡改行爲。文本水印還將通過 AWS、Google Cloud 和 Microsoft Foundry 等雲合作伙伴生效,不過這些平臺可能不支持簽名元數據。Anthropic 計劃後續發佈驗證工具,供用戶和第三方檢測這些標識。

水印檢測存在固有侷限

Anthropic 坦承水印技術存在明顯限制:檢測到水印並不意味着該內容完全由 Claude 生成,因爲用戶經常使用 Claude 進行校對、翻譯或摘要,輸出內容可能攜帶水印但核心思想來自人類。同樣,未檢測到水印也不能排除 AI 的參與——模型可能在水印功能上線前就已輸出、文本可能經過重度編輯或翻譯、段落可能過短無法可靠檢測,或元數據在格式轉換和截圖中被剝離。水印能否在編輯、重排版和翻譯後存活,將是檢驗其真正價值的關鍵測試。

AI 文本檢測在教育等社會敏感領域影響尤爲深遠。研究表明過度依賴 AI 工具會削弱批判性思維和寫作能力,已有詐騙者利用 AI 註冊虛假學生身份騙取助學金。然而不可靠的檢測器同樣危險,可能導致誤判學生作弊的錯誤指控。Anthropic 的水印方案若比現有第三方檢測工具更可靠,或將爲這一困局提供新的出路。

行業格局:各家態度分化

Anthropic 並非唯一探索水印技術的公司。Google DeepMind 已開源 SynthID 水印系統並內置於 Gemini 模型中,通過在詞元預測時微調概率值實現不降質水印,支持多語言但同樣在編輯後檢測困難。相比之下,OpenAI 擁有準確率達 99.9% 的文本檢測器卻擱置兩年未發佈,原因包括用戶可通過翻譯或改寫輕鬆繞過、可能污名化特定羣體,以及公開檢測器可能損害自身商業利益。

Anthropic 的決定也可能帶來商業風險。Claude 在知識工作領域尤其受學生歡迎,更可靠的檢測能力可能降低這部分用戶的吸引力。但隨着 AI 生成內容氾濫和深度僞造風險加劇,內容溯源已從可選項變爲必選項,率先建立可信標識體系的廠商將在監管趨嚴的環境中獲得先發優勢。