AnthropicのClaudeテキスト透かし、意味を変えると批判
मूल शीर्षक: Anthropic's 'watermark' text adulteration in Claude is a perversion of writing
यह क्यों महत्वपूर्ण है
AI生成コンテンツの透かし技術はEU規制対応の核心であり、品質と透明性のトレードオフが業界標準に影響する重要な問題。
John Gruberは2026年8月16日、AnthropicがClaudeの全モデルにテキスト透かし機能を導入する計画について批判的な記事を発表した。EUの規制に準拠するためこの機能が実装されるが、Anthropicの公式説明と実際の仕組みに矛盾があると指摘している。
Daring FireballのJohn Gruberは、AnthropicがEU規制に対応するためClaudeの全モデルに導入予定のテキスト透かし(watermarking)機能を詳しく分析し、同社の説明に重大な矛盾があると批判した。
Anthropicの当初のサポートドキュメント「How Claude Marks AI-Generated Content」では、「imperceptible(知覚できない)」な透かしが埋め込まれ、「テキストの意味、品質、読みやすさに変化はない」と明記されていた。この説明を受け、Gruberは当初、Unicodeの非表示文字を使用する手法を想定していた。
しかしAnthropicが後日別のページで公開した「How Claude's Text Watermark Works」という記事によると、実際の手法はステガノグラフィー(steganography)の一種であり、推論時に単語やトークンの選択を意図的に変化させることで、確率的に後から検出可能な「指紋」を埋め込む仕組みだと明らかになった。
Gruberはこの手法について、テキストの意味や語彙の選択に実際に変更を加えるものであり、当初の「意味に変化なし」という説明と矛盾すると指摘した。また、James Padolseyによるインタラクティブ解説「How AI Text Watermarking Works」を引用し、この技術の基本原理(コイントスのバイアス検出に類似した確率的手法)についても解説している。
Gruberは、AIが生成するテキストの品質や意味を透かし埋め込みのために犠牲にすることは容認できないとし、Anthropicの不透明かつ矛盾した説明姿勢を強く批判した。