米アンソロピック、Claude生成コンテンツに機械可読の透かし導入

2026年8月13日 11:56

 米アンソロピック(Anthropic)は、生成AI「Claude」が生成・処理するコンテンツに機械で読み取れる印を付与する。文章の校正や翻訳だけにClaudeを使った場合も透かしが残る可能性があり、利用の有無を判定する際には注意が必要となる。

 Anthropicは、欧州連合(EU)のAI規制への対応として、Claudeが生成・処理するコンテンツに機械可読の印を組み込む。対象は、2026年8月2日以降にEUで公開されるClaudeの対応モデルである。透かしはEU域内に限らず、Claudeが提供される世界各地で適用する。ClaudeのAPI、Claude Code、Claude Cowork、Claude Tagのほか、AWS、Google Cloud、Microsoft Foundryを通じた利用も対象となる。ただし、プラットフォームや機能によっては一部の印付け方式に対応しない場合がある。

 文章については、人間には認識できない透かしをテキスト自体に埋め込む。文章の意味や品質、読みやすさには影響せず、別の場所にコピーして貼り付けた場合や、一部を編集した場合にも残る可能性がある。

 Claudeが対応する形式のファイルを生成した場合は、デジタル署名付きの来歴情報をメタデータとして付与する。画像では「.svg」「.png」「.jpg」などが例として挙げられている。メタデータには、コンテンツの来歴を記録する業界標準「C2PA」を採用する。署名付きメタデータがあれば、そのファイルがClaudeによって処理されたことや、処理後に改変されたかどうかを確認できる。

 今回の対応は、生成AIシステムの提供者に透明性確保を求め、AIが生成または操作した一定のコンテンツを識別可能にするEUのAI法第50条を踏まえたものだ。Anthropicは同条第2項に関する「AI生成コンテンツの透明性に関する行動規範」に署名している。

 ただし、透かしが検出されても、文章そのものをClaudeが執筆したとは限らない。人間が作成した文章をClaudeで校正、翻訳、要約したり、別の形式に変換したりした場合にも、出力に透かしが付く可能性がある。

 この点は、生成AIを執筆者ではなく編集支援ツールとして使う報道機関、広報会社、企業の広報部門などにとって特に重要となる。透かしの検出は、コンテンツがClaudeによって処理された可能性を示すにとどまり、その来歴全体を確定するものではない。

 一方、Claudeが生成した文章でも透かしを検出できない場合がある。文章が大幅に編集・言い換え・翻訳された場合、別の文章と組み合わされた場合、文章が短すぎる場合などには、検出の信頼性が低下する。ファイルの形式変換や再保存、スクリーンショットの作成などによって、来歴情報のメタデータが失われる可能性もある。

 従来のAI文章判定では、外部ツールが単語の選択、文章構造、予測可能性などを分析し、人間と機械のどちらが書いた可能性が高いかを推定する手法が使われてきた。今回の透かし方式では、AI開発企業がモデルの出力に識別用の信号を直接組み込むことになる。

 EUの透明性要件への対応を進めているのはAnthropicだけではない。
 OpenAIもEUの「AI生成コンテンツの透明性に関する行動規範」への支持を表明している。同社が現時点で明らかにしている透かし・来歴管理の仕組みは、対応する画像と音声を対象としており、テキスト向けの仕組みは公表していない。

 オンラインプラットフォームでも、本物のコンテンツと大量生産されたAIコンテンツを区別する取り組みが進む。LinkedInは、投稿やコメントが低品質なAI生成コンテンツに見える場合に利用者が報告できる「AIスロップのようだ」との選択肢を段階的に導入している。

 ニュースレター配信サービスのSubstackは、AI文章検出企業Pangramの技術を使い、利用者が投稿やコメントについてAI生成・AI支援の可能性を調べられる機能を導入した。

 Snapは、全面的にAIで生成された動画を、短尺動画サービス「Spotlight」のおすすめ対象から外した。AIを使って編集・加工したコンテンツは引き続き対象となる。

 Anthropicは、2026年8月2日より前に公開したClaudeモデルにも印付け機能を追加する作業を進めている。透かしや来歴情報を利用者や第三者が検出する仕組みについては、今後公開する技術文書で詳細を示すとしている。

関連記事

最新記事