検索
ニュース

メモ帳にコピペしても消えない? Claudeが文章に仕込む“見えないAIマーク”“作AI”をどう証明するか

AIで生成された文章は、見た目だけでは人間が書いたものと区別しにくいが、そんな状況が変わるかもしれない。AnthropicはClaudeの生成テキストに、人間には見えない透かしを埋め込む取り組みを開始した。しかも、その痕跡はコピー&ペースト後にも残る可能性があるという。

Share
Tweet
LINE
Hatena

 Anthropicは「Claude」が生成したコンテンツの出どころや透明性を客観的に評価できるようにするための取り組みを発表した。

 テキスト内部に人間には認識できない透かしを仕込む「不可視透かし(埋め込みウオーターマーク)」と、画像などのファイルに付与する「デジタル署名入りプロバナンス(由来)メタデータ」の2つの技術を組み合わせて実装される。

 この取り組みの背景には、2026年8月2日(現地時間、以下同)から適用が始まった欧州連合(EU)の「EU AI法」(EU AI Act)第50条第2項がある。同項では、AIが生成するテキストや画像などについて、機械可読な形式でマーキングし、AIによる生成・加工物であることを検出可能にするよう、AIシステムの提供者に求めている。

 2026年8月2日以降にローンチされる新しいClaudeモデルでは、提供開始時からマーキングに対応する。対象モデルではEU域外を含めてグローバルに適用され、既存モデルにも順次対応を拡大する。

メモに張り付けてコピペでも“AI生成”とバレるのか?

 「不可視透かし」とは、Claudeモデルがテキストを生成するとき、文章の内部に人間の目には知覚できないパターン(透かし)情報を直接織り込む技術だ。この透かしは不可視であり、Claudeが回答する文章の意味内容や可読性、生成品質を落とすことなく埋め込まれる。

 Anthropicによると、透かしはテキスト自体に組み込まれるため、生成された文章をコピーして別のアプリケーションやWebサイトに貼り付けた場合でもテキストとともに移動し、一部の編集後にも保持される可能性がある。

 この処理はモデルレベル(生成エンジン自体)で施されるため、どのClaude製品やUI、APIから出力されたテキストであっても不可視透かしが含まれる。

 「デジタル署名入りプロバナンスメタデータ」とは、Claudeが「.svg」「.png」「.jpg」といった画像ファイルやサポート対象のファイル形式を出力・処理する際に、デジタル署名されたプロバナンスメタデータが添付する技術だ。

 このメタデータには、メディア業界やIT標準化団体で広く採用されているOpen Standard(オープン標準)規格「Coalition for Content Provenance and Authenticity」(C2PA)が採用されている。ファイルに付与されたC2PAのメタデータを検証することで、Claudeによる処理や、その後の変更履歴などを確認できるようにする。

識別マークも万能ではない 付与されないパターンは?

 これらの識別マークは、コンテンツの出どころを把握する重要なシグナルとなる一方、あらゆるコンテンツや利用状況において万能な判定手段ではないとAnthropicは指摘している。

 例えば、原著作者がClaudeではないケースがそれに当たる。ユーザーは文章の校正や翻訳、要約、フォーマット変換などの目的でClaudeを利用することが多い。この場合、原案となるアイデアや基本テキスト、データ自体は人間や他の情報源から作成されたものであっても、処理後の出力物にはClaudeの識別マークが付与される。

 また、Claudeによって生成された後、人間がテキストが大幅に改変したり、一部が抜粋したり、他の文章と統合したりした場合でも識別マークが付与される。

 つまり識別マークが検出されても、それが「全ての内容をClaudeが独自に執筆した」という完全な証明にはならない。

 一方、コンテンツに識別マークが検出されなかったからといって、そのコンテンツがAIによって生成されていない、あるいはClaudeを通していないと断定することもできない。以下の条件に該当する場合、Claudeで処理されたコンテンツであっても識別マークが検出されない、あるいは失われるケースが生じるという。

  • マーキング非対応の時期にリリースされた旧モデルで生成された場合
  • テキストが人間によって大幅に編集、言い換え、翻訳、または他の文章と混ざり合わされた場合
  • 生成された文章自体が非常に短く、信頼性のある透かし信号を読み取るための十分なデータ量がない場合
  • ファイルのフォーマット変換、再保存、スクリーンショット撮影などによってメタデータが欠損・除去された場合
  • 特定のマーキング方式をサポートしていないプラットフォーム、機能、またはファイル形式を経由して出力された場合

付与マークを検出する仕組みも順次提供

 Anthropicによると、識別マーク対応のロードマップの骨子は以下の通りだ。

  • 新モデルへの即時適用:2026年8月2日以降にEU市場で発表またはローンチされる新しいClaudeモデルは、提供開始初日から識別マークの付与に対応する。
  • あらゆるClaude利用環境に適用:識別マークは、API提供基盤「Claude Platform」(API)をはじめ、Web/アプリ版「Claude」、開発者向けCLIツール「Claude Code」、共同作業ツール「Claude Cowork」、タグ管理機能「Claude Tag」など、全てのClaude関連製品およびインタフェースからの出力にグローバルで適用される。
  • クラウド経由での適用:「Amazon Web Services」(AWS)「Google Cloud」「Microsoft Foundry」などのクラウド経由でClaudeモデルにアクセスした場合でも、生成テキストへの埋め込みウオーターマークが適用される。ただし、ファイルへの署名入りプロバナンスメタデータについては、クラウドプラットフォームが提供する固有の機能や仕様によってサポート状況が異なる場合がある。
  • 既存モデルへの順次対応:Anthropicは既存のClaudeモデルについてもマーキング機能を順次追加できるよう準備を進めている。

 Anthropicは識別マークを埋め込むのに加えて、指定されたテキストやファイルの中にClaude固有の埋め込み透かしやC2PAメタデータがあるかどうかを解析・チェックする「検出機能」の提供も進めるとしている。

 同社は、サードパーティーや一般ユーザーがこれらの識別マークを独自に検出・確認できるようにするための具体的な仕様やツール、技術ドキュメントを今後順次提供する計画を示した。

 Claudeモデルを自社製品やサービス、システム内に組み込んで提供しているサードパーティー事業者や開発者は、自社の成果物がEU AI法第50条の規定にどのように該当するかを自ら評価・確認することが推奨される。

Copyright © ITmedia, Inc. All Rights Reserved.

ページトップに戻る