Anthropic、Claudeの透かし技術の詳細を公開
Judul asli: Anthropic shares more details about how Claude’s new watermarks will work
Mengapa Ini Penting
AI生成コンテンツの透明性確保に向けた業界標準形成の動向として注目される。
AnthropicはClaude生成テキストに透かしを埋め込む仕組みを説明。EU AI ActのTransparency Codeに準拠し、Google DeepMindのSynthID-Text方式を採用、検出APIも公開予定。
AnthropicはClaude生成テキストへの透かし(ウォーターマーク)技術の詳細をブログ記事で公表した。EU AI ActのTransparency Codeへの対応として導入するもので、AIが生成したコンテンツの識別を可能にすることが目的。
技術的にはGoogle DeepMindが2024年に発表したSynthID-Text方式を採用する。「overcast」と「grey」のように意味が同等な単語の選択など「低リスクな判断」の場面で、読者には気づかれないパターンをレスポンスに埋め込む仕組みで、出力品質への影響はないとしている。また、透かしを検出するAPIの公開も予定している。
透かしの除去については、軽微な編集では完全には消えないものの、全単語を書き換えれば除去可能と説明。コードについては動作する必要があるため選択の自由度が低く、透かしの影響は小さいが、コード内コメントなど任意表現が使える箇所には透かしが付く場合があるとしている。
この発表を受けてRedditやXでは賛否両論が飛び交い、Business Insiderによれば「数十人」のユーザーがClaude購読をキャンセルしたと報告されている。