Anthropic はEUのAI法案実践ガイドラインに署名し、2026年8月から公開されるすべてのClaudeモデルが世界中でコンテンツ識別子を組み込むことを発表しました。この要件はヨーロッパ市場に限らず、API、Claude、Claude Code、Claude Cowork、Claude Tagを含むすべてのClaude製品ラインに適用されます。既存のモデルには法的移行期間が与えられますが、Anthropicはすでに水印機能の後方互換性の作業を進めています。
Anthropicは2つの識別メカニズムを採用しています。テキスト出力には、内容の意味や読みやすさに影響しない非表示のウォーターマークが含まれており、コピー&ペースト後でも存在します。「ある程度の編集後でも保持される可能性があります」。画像などのファイル形式には、C2PAオープン標準に基づいたデジタル署名のトレーシングメタデータが追加され、この署名はファイルがClaudeによって処理されたことを示し、その後の改ざん行為を明らかにできます。テキストウォーターマークはAWS、Google Cloud、Microsoft Foundryなどのクラウドパートナーを通じて有効になりますが、これらのプラットフォームではメタデータの署名をサポートしない可能性があります。Anthropicは後日、ユーザーおよび第三者がこれらの識別子を検出するための検証ツールをリリースする予定です。
ウォーターマークの検出には固有の制限がある
Anthropicはウォーターマーク技術の明確な制限を認めています。ウォーターマークが検出されても、そのコンテンツが完全にClaudeによって生成されたことを意味しないことがあります。なぜなら、ユーザーはよくClaudeを使って校正や翻訳、要約を行っており、出力されたコンテンツがウォーターマークを含んでいるかもしれませんが、核心的な考えは人間にあるからです。同様に、ウォーターマークが検出されなくてもAIの参加を排除することはできません。モデルが出力したのはウォーターマーク機能が導入される前にであり、テキストが重度に編集または翻訳されており、セグメントが短すぎて信頼できる検出が不可能である場合、またはメタデータが形式変換やスクリーンショットで削除されている可能性があるからです。ウォーターマークが編集、再構成、翻訳後に生き残るかどうかが、その真の価値をテストする鍵となります。
AIテキスト検出は教育などの社会的に敏感な分野において特に大きな影響を与えます。研究によると、AIツールに過度に依存すると批判的思考や作文能力が低下し、すでに詐欺者がAIを使用して架空の学生身份を登録して奨学金を詐取しているとの報告があります。しかし、正確でない検出器も危険で、誤って学生が不正行為をしたと誤って指摘する可能性があります。Anthropicのウォーターマーク方案が既存のサードパーティ検出ツールより正確であれば、この難局に新たな解決策を提供するかもしれません。
業界の状況:各社の態度が分かれる
Anthropicが唯一ウォーターマーク技術を探求している会社ではありません。Google DeepMindはSynthIDウォーターマークシステムをオープンソース化し、Geminiモデルに内蔵しており、単語予測時に確率値を微調整することで品質を損なうことなくウォーターマークを実現し、多言語をサポートしますが、編集後の検出が難しいという問題もあります。これに対し、OpenAIは99.9%の正確率を持つテキスト検出器を持っていましたが、2年間リリースされていません。理由としては、ユーザーが翻訳や再構成で簡単に回避できること、特定のグループを悪者にすることになる可能性、公開された検出器が自身のビジネス利益を損なう可能性などがあります。
