AnthropicがClaudeの透かし機能の詳細を公開

मूल शीर्षक: Anthropic shares more details about how Claude’s new watermarks will work

यह क्यों महत्वपूर्ण है

EU AI法の透明性要件への業界対応として、AI生成コンテンツの識別技術の標準化に向けた重要な先例となる。

Anthropic は2026年8月15日、AIチャットボット「Claude」が生成するテキストに埋め込む透かし(watermark)の仕組みについて詳細を公式ブログで公開した。EU AI法の透明性コードへの対応が目的で、SynthID-Textの手法を採用する。

Anthropicは、EU AI法の透明性コード(Transparency Code)への準拠を目的として、Claudeが生成するテキストに透かしを埋め込む方針を今週発表していた。今回の公式ブログ投稿では、その技術的な詳細を説明している。

透かしの仕組みとして、Claudeは「overcast」と「grey」のような同等の語を選ぶ際に特定のパターンを生成し、読者には判別不能だが専用の「キー」を持つ者には検出可能な痕跡を埋め込む。Anthropicは「透かしはClaudeの出力品質に影響しない」と述べており、透かし付きと未付きの文章は読者には区別できないとしている。

技術的にはGoogle DeepMindが2024年に発表したSynthID-Textのアプローチを採用し、透かし検出APIも公開予定。PangramなどのAI検出サービスが「it's not [X], it's [Y]」などの文章パターンを探す手法とは根本的に異なると説明している。

編集による透かし除去については、「軽微な編集では完全には消えない」が、「全ての単語を書き換える完全な書き直しでは消える」と認めた。後者の場合、もはやAI生成テキストとは言えないとも述べた。

Claudeが校正・編集のみに使われた場合は、テキストの長さと編集量に依存し、軽微な編集なら「ほぼ全ての単語」が人間の著作物であるため透かしはほとんど付かない。コードについては動作確保のために選択の自由が少なく透かしの影響は軽微だが、コメント部分では適用されると説明した。

この方針に対してRedditやXでは賛否両論が起き、Business Insiderによると「数十人」のユーザーがサブスクリプションをキャンセルしたと報告されている。

स्रोत

techcrunch.com — मूल लेख पढ़ें →