8月11日消息,Anthropic宣佈將在新的Claude模型中加入“不易察覺的水印”技術,用於標識AI生成文本來源。該水印不會影響文本含義和閱讀體驗,可在複製粘貼過程中隨內容保留,並可能在部分編輯操作後繼續存在。
Anthropic表示,該功能是其根據歐盟《人工智能法案》推動AI透明度的一項措施。自8月2日及之後發佈的Claude模型起,生成內容將支持標記識別,覆蓋全球範圍內通過Claude生成的文本,包括通過雲服務商調用的版本。公司還計劃向第三方提供水印檢測工具,並正在考慮將該能力擴展至舊版模型。

此次技術升級被認爲可能影響出版、教育等高度依賴文本原創性的領域。近年來,AI生成內容冒充人工創作的問題持續引發爭議,部分出版項目曾因涉嫌使用AI文本而受到質疑。Claude文本水印可爲出版社、學校和高校提供新的內容溯源手段,幫助識別未經披露的AI生成作品。
不過,Anthropic也指出,水印並非絕對可靠。對AI生成文本進行大規模編輯、改寫、翻譯,或與其他內容混合處理,都可能導致水印無法檢測。此外,檢測到水印只能證明內容曾由Claude參與生成,並不能直接證明Claude是文本的唯一作者,因爲校對、翻譯等輔助操作同樣可能留下標記。
Anthropic並非首家探索AI文本標識技術的企業。2024年,谷歌DeepMind已宣佈通過SynthID技術爲Gemini生成的文本和視頻添加水印,此前該技術已應用於AI圖像領域。隨着生成式AI應用普及,AI內容識別與來源追蹤正成爲行業透明化發展的重要方向。
