メインコンテンツへスキップ
  1. 記事一覧/

AnthropicがClaudeの透かし技術を解説:SynthID-Textを採用

·4 分
著者
Alicia
AI・IT・ハードウェアの最新ニュースを自動配信するテックブログです。
目次
サムネイル

Claudeに「見えない透かし」が入る——AnthropicがEU規制対応の技術を公開
#

Anthropicは、自社のAIモデル「Claude」が生成したテキストに不可視の電子透かしを付与する仕組みを公式に説明した。この取り組みはEUのAI法(AI Act)への準拠を目的としており、Google DeepMindが開発したオープンソース技術「SynthID-Text」を採用している。


なぜ今、テキスト透かしが必要なのか
#

EUのAI法は、AIが生成・加工した音声・画像・動画・テキストに対して、機械が読み取れるマーク(機械可読マーク)を付与し、それがAIによって生成または操作されたコンテンツであることを検出可能にすることを義務付けている。Anthropicによるこの機能追加は、同法の要件を満たすための対応措置だ。

なお、Claude生成画像に対しては、別途「C2PA(Coalition for Content Provenance and Authenticity)」サポートも合わせて導入されるとのことで、テキストと画像の両面でEU規制への対応が進められている。


「SynthID-Text」とは何か——仕組みをわかりやすく解説
#

SynthID-TextはGoogle DeepMindが開発したテキスト透かし技術で、現在はオープンソースとして公開されている。AnthropicはClaudeに「このアプローチのバージョン」を採用したと説明している。

この技術の核心は、AIがテキストを生成する際の「単語選択の確率」を巧みに利用する点にある。Anthropicが示した具体的な説明を要約すると、以下のようになる。

通常の単語生成プロセス:

  • 例えば「今日の天気は寒くて…」という文の続きとして、「ざらざらした」という単語が来る確率は極めて低い。一方、「曇り」や「どんより」といった単語が来る確率は高い。
  • こうした「どちらでも文意が変わらない低リスクな選択」が、テキスト全体にわたって何度も発生する。
  • 通常はランダムな乱数によってこれらの選択が決まる。

透かし付き生成プロセス:

  • 透かし機能を有効にした場合も選択はランダムに行われるが、その「乱数の発生源」が変わる。
  • 任意の乱数生成器の代わりに、「透かし用のキー」と「直前のいくつかの単語」を組み合わせて次の単語を決定する。
  • これにより、テキスト全体に人間の目には見えないパターンが埋め込まれる。
  • そのパターンは、キーを持つ者(検出者)だけが検出できる。

つまり、文章の意味や読みやすさには影響を与えずに、統計的なパターンとして「AI製であること」の証拠を文中に潜ませる技術だ。


ユーザーへの影響は?
#

Anthropicは「この透かし機能はClaudeをユーザーにとって高価にすることはなく、またClaudeの出力品質やコンテンツに実質的な影響を与えない」と明言している。透かしの存在は読者には感知できず、テキストの意味や流暢さにも変化はないとされる。


業界全体の動向——ClaudeだけではないAI透かしの波
#

Anthropicが指摘するように、EU AI法はAnthropicだけでなく、主要なAI開発企業すべてに適用される。

  • Google:Geminiチャットボットは2024年からすでにSynthID-Textを採用済み。
  • OpenAI:ChatGPTのAI法対応ロードマップではテキスト透かしの詳細は明らかにされていないが、同社も同法の要件に従う必要がある。

すなわち、テキスト透かしはAI業界全体に広がる流れであり、Claudeはその一環として対応を進めている状況だ。


まとめ
#

AnthropicはEU AI法への対応として、Google DeepMindのSynthID-Textをベースにした不可視テキスト透かしをClaudeに導入することを発表・説明した。この技術は単語選択の確率的なパターンを利用してAI生成コンテンツを識別するもので、ユーザーが体感できるような品質への悪影響はないとされる。GoogleのGeminiはすでに同技術を採用しており、OpenAIも規制対象となっているため、AI生成テキストへの透かし付与は今後業界スタンダードになっていく可能性が高い状況といえる。

筆者の見解: テキスト透かしが「見えない形で」実装されるという点は興味深い。技術の透明性を高めつつも、ユーザー体験を損なわない設計思想は評価できる。一方で、キーを持つ「検出者」が誰になるのか、透かし除去への耐性はどの程度かといった点については、今回のソースでは明らかにされていないため、詳細は元記事および関連発表を参照されたい。


出典: Anthropic explains how Claude’s invisible text watermarks will work

関連記事