ClaudeのAI透かしを数時間で回避する方法が公開
मूल शीर्षक: Coders Say They Already Found Workarounds to Claude’s Invisible Watermarks
यह क्यों महत्वपूर्ण है
EU AI法の透かし義務化が施行直後に技術的に回避される事態は、AI規制の実効性と業界標準の信頼性に大きな疑問を投げかける。
Anthropicがクロードモデルに不可視透かしを全世界で埋め込むと発表した数時間後、開発者Guillaume MeyerがGitHubに除去コードを公開。そのコードはX上で2万回以上ブックマークされ、100人超の貢献者を集めた。
AnthropicはEUのAI法(AI Act)に準拠するため、Claudeが生成するすべてのテキストに機械可読の不可視透かし(ウォーターマーク)を埋め込むと先週発表した。ところが発表からわずか4時間以内に、フランス人開発者Guillaume MeyerがGitHubに透かし除去コードを公開。このコードはX上で2万件以上ブックマークされ、100人超の貢献者が参加、さらに多くの開発者が自身のプロジェクトに組み込んでいる。
EUのAI法は今月初めに施行され、AnthropicやOpenAIなどのモデル提供者に対し、AI生成の音声・画像・動画・テキストを機械が検出できる形でラベリングすることを義務付けている。違反した場合は年間売上高の最大3%の制裁金が科される。規則は提供者による回避ツールの販売・宣伝を禁じているが、独立した個人ツールへの法的制限はない。
Meyerは透かし技術そのものへの反対意見を持つ。フランス語を母語とする彼はClaudeやGrammarlyなどのAIツールを文章編集に活用しており、透かしが軽微なAI利用と全面的な利用を区別できない点や、偽陽性のリスクを懸念する。「透かしは非常に悪い解決策だ。重大な欠点とリスクがある」と語る。Anthropicも透かしはClaude関与の確率を示すに過ぎないと認めており、就職候補者の不当な不採用や研究者への不当な非難につながる恐れがあるとMeyerは指摘する。
Anthropicが採用した技術はGoogleが2023年から使用する「SynthID」で、Claudeの語句選択にパターンを埋め込み、人間には判別できないが機械には検知可能にする仕組み。MeyerはウォーターマークなしのLLMを使った別の手法で除去を実現した。なお、OpenAIでも元Google研究者Scott Aaronsonが類似手法を提案していたが、顧客離れを懸念し導入されなかった経緯がある。