AIで生成された文章は、見た目だけでは人間が書いたものと区別しにくいが、そんな状況が変わるかもしれない。AnthropicはClaudeの生成テキストに、人間には見えない透かしを埋め込む取り組みを開始した。しかも、その痕跡はコピー&ペースト後にも残る可能性があるという。
この記事は会員限定です。会員登録(無料)すると全てご覧いただけます。
Anthropicは「Claude」が生成したコンテンツの出どころや透明性を客観的に評価できるようにするための取り組みを発表した。
テキスト内部に人間には認識できない透かしを仕込む「不可視透かし(埋め込みウオーターマーク)」と、画像などのファイルに付与する「デジタル署名入りプロバナンス(由来)メタデータ」の2つの技術を組み合わせて実装される。
この取り組みの背景には、2026年8月2日(現地時間、以下同)から適用が始まった欧州連合(EU)の「EU AI法」(EU AI Act)第50条第2項がある。同項では、AIが生成するテキストや画像などについて、機械可読な形式でマーキングし、AIによる生成・加工物であることを検出可能にするよう、AIシステムの提供者に求めている。
2026年8月2日以降にローンチされる新しいClaudeモデルでは、提供開始時からマーキングに対応する。対象モデルではEU域外を含めてグローバルに適用され、既存モデルにも順次対応を拡大する。
「不可視透かし」とは、Claudeモデルがテキストを生成するとき、文章の内部に人間の目には知覚できないパターン(透かし)情報を直接織り込む技術だ。この透かしは不可視であり、Claudeが回答する文章の意味内容や可読性、生成品質を落とすことなく埋め込まれる。
Anthropicによると、透かしはテキスト自体に組み込まれるため、生成された文章をコピーして別のアプリケーションやWebサイトに貼り付けた場合でもテキストとともに移動し、一部の編集後にも保持される可能性がある。
この処理はモデルレベル(生成エンジン自体)で施されるため、どのClaude製品やUI、APIから出力されたテキストであっても不可視透かしが含まれる。
「デジタル署名入りプロバナンスメタデータ」とは、Claudeが「.svg」「.png」「.jpg」といった画像ファイルやサポート対象のファイル形式を出力・処理する際に、デジタル署名されたプロバナンスメタデータが添付する技術だ。
このメタデータには、メディア業界やIT標準化団体で広く採用されているOpen Standard(オープン標準)規格「Coalition for Content Provenance and Authenticity」(C2PA)が採用されている。ファイルに付与されたC2PAのメタデータを検証することで、Claudeによる処理や、その後の変更履歴などを確認できるようにする。
これらの識別マークは、コンテンツの出どころを把握する重要なシグナルとなる一方、あらゆるコンテンツや利用状況において万能な判定手段ではないとAnthropicは指摘している。
例えば、原著作者がClaudeではないケースがそれに当たる。ユーザーは文章の校正や翻訳、要約、フォーマット変換などの目的でClaudeを利用することが多い。この場合、原案となるアイデアや基本テキスト、データ自体は人間や他の情報源から作成されたものであっても、処理後の出力物にはClaudeの識別マークが付与される。
また、Claudeによって生成された後、人間がテキストが大幅に改変したり、一部が抜粋したり、他の文章と統合したりした場合でも識別マークが付与される。
つまり識別マークが検出されても、それが「全ての内容をClaudeが独自に執筆した」という完全な証明にはならない。
一方、コンテンツに識別マークが検出されなかったからといって、そのコンテンツがAIによって生成されていない、あるいはClaudeを通していないと断定することもできない。以下の条件に該当する場合、Claudeで処理されたコンテンツであっても識別マークが検出されない、あるいは失われるケースが生じるという。
Anthropicによると、識別マーク対応のロードマップの骨子は以下の通りだ。
Anthropicは識別マークを埋め込むのに加えて、指定されたテキストやファイルの中にClaude固有の埋め込み透かしやC2PAメタデータがあるかどうかを解析・チェックする「検出機能」の提供も進めるとしている。
同社は、サードパーティーや一般ユーザーがこれらの識別マークを独自に検出・確認できるようにするための具体的な仕様やツール、技術ドキュメントを今後順次提供する計画を示した。
Claudeモデルを自社製品やサービス、システム内に組み込んで提供しているサードパーティー事業者や開発者は、自社の成果物がEU AI法第50条の規定にどのように該当するかを自ら評価・確認することが推奨される。
「シャドーClaude」対策が可能に Anthropicが「Compliance API」公開
AIが誤コンテンツを生む「AIスロップ」という深刻な問題 対策は?
なぜClaude Fable 5が標的に? 米政府が最新AIを突如停止させた理由
【2026年2月版】生成AI 6大サービス比較:企業を情報漏えいから守るための管理者ガイド
「この1年はAI戦国時代」 メルカリに学ぶ、AIガバナンス策定の勘所Copyright © ITmedia, Inc. All Rights Reserved.