AnthropicがClaudeの透かし機能の詳細を公開
원제: Anthropic shares more details about how Claude’s new watermarks will work
왜 중요한가
EU AI法対応の透かし技術採用は、AI生成コンテンツの透明性確保に向けた業界標準化の重要な先行事例となる。
Anthropicは2026年8月15日、AIチャットボットClaudeが生成するテキストへの電子透かし(ウォーターマーク)機能について詳細をブログで公開した。EU AI法の透明性規範への準拠が目的で、Google DeepMindが2024年に発表したSynthID-Textの手法を採用し、検出用APIも提供予定とした。
AnthropicはEU AI法(EU AI Act)の透明性規範(Transparency Code)に準拠するため、Claudeが生成するテキストに電子透かしを埋め込むことを今週初めに発表。2026年8月15日付のブログ記事で、その仕組みをより詳しく説明した。
透かしの仕組みとしては、「overcast」か「grey」のような単語選択など「影響の低い選択肢」を選ぶ際にパターンを組み込む方式を採用。読者には検知不可能だが、専用キーを持つ者には判別可能となる。Anthropicは「透かしはClaudeの出力品質に影響しない」と明言した。
採用技術はGoogle DeepMindが2024年に発表したSynthID-Textで、ウォーターマーク検出APIも公開予定。文章の「癖」を検出する従来型AI検出サービス(Pangram等)とは根本的に異なるアプローチとしている。
編集による回避については、「軽微な編集では透かしは完全には除去されない」が、「全ての単語を書き直す完全な書き換えでは除去可能」と説明。ただし完全書き換えの場合は「AI生成コンテンツと呼べるかどうか自体が疑問」とした。
コードに関しては、動作するコードを生成する必要があるため自由度が低く、他テキストに比べ透かしの埋め込み量は少ないとしている。コード内のコメント部分などには適用可能だが「実際のコードへの影響は無視できる程度」とした。
今回の発表に対しRedditやX上では賛否が分かれており、Business Insiderは「数十人」のユーザーがClaudeのサブスクリプションをキャンセルしたと報じている。