8月11日付の情報によると、Anthropicは新しいClaudeモデルに「目立たない水印」技術を導入し、AIによって生成されたテキストの出所を識別するための手段として使用することを発表しました。この水印はテキストの意味や読みやすさには影響を与えず、コピー&ペーストの際に内容とともに保持され、一部の編集操作後にも残る可能性があります。
Anthropicはこの機能が、EUの「人工知能法案」に基づくAIの透明性向上を推進するための取り組みであると説明しています。8月2日以降にリリースされるClaudeモデルからは、生成されたコンテンツに識別可能なマーカーが追加され、クラウドサービスプロバイダーを通じて利用されるバージョンを含む、世界中でClaudeによって生成されたテキストすべてに適用されます。企業はまた、第三者向けに水印検出ツールを提供する計画をしており、古いモデルへのこの機能の拡張も検討しています。

今回の技術革新は、出版や教育などテキストの独自性に強く依存する分野に影響を与える可能性があります。近年、AIによって生成されたコンテンツが人間による創作であるかのように誤解される問題が頻繁に議論されてきました。Claudeのテキストに付与される水印は、出版社や学校、大学などが新たなコンテンツのトレース手段を提供し、開示されていないAI生成作品を識別するのに役立つでしょう。
ただし、Anthropicは水印が絶対的に信頼できるものではないことも指摘しています。大規模なAI生成テキストの編集・再構成・翻訳、または他のコンテンツと混合処理を行うと、水印が検出できなくなる可能性があります。さらに、水印が検出されたとしても、それがそのテキストがClaudeによって唯一生成されたことを証明するものではなく、校正や翻訳などの補助作業でもマークが残る可能性があるため注意が必要です。
