Microsoft幹部がAIスクレイピングを「人類史上最大の労働搾取」と認めた内部文書

मूल शीर्षक: Microsoft exec called AI scraping 'the largest theft of labor in human history'

यह क्यों महत्वपूर्ण है

幹部の内部発言がフェアユース主張と矛盾するため、係争中のAI著作権訴訟全体に影響を与えうる。

The New York TimesがOpenAIとMicrosoftを訴えた著作権訴訟の非公開資料が公開され、Microsoft幹部がAIトレーニングを「窃盗」と表現し、OpenAI幹部が自社モデルが出版社にとって「実存的脅威」と認めていたことが明らかになった。

2023年にThe New York Timesが提起した著作権侵害訴訟において、新たに非公開資料が開示された。これにより、MicrosoftとOpenAIの幹部が内部でAIトレーニングの問題性を認識していたことが浮き彫りになった。

Microsoftの応用科学担当ディレクター、Brent Hechtが2024年1月に作成した内部プレゼンテーションによると、Copilotの「回答エンジン」がThe New York Timesへのクリック率を従来のBing検索と比べ最大93%減少させたという自社データが存在した。同文書はこの状況を「負の連鎖(doom loop)」と表現し、「モデルのパフォーマンスとウェブ全体を同時に損なう」と指摘。また「最終製品が不可欠なサプライヤーの経済的基盤を脅かすことは極めて異例だが、我々はLLMビジネスにおいてまさにその状況を作り出してしまった」と記されていた。

Microsoft CEOのSatya Nadellaは今年の証言で、「ペイウォール内のコンテンツはグラウンディングや学習目的で使用したい者全員がライセンスを取得すべきだ」と述べており、OpenAIがペイウォール越えでスクレイピングしたことを事前に知っていたなら対応が異なっていたと示唆した。

資料にはまた、コンテンツのペイウォールを検知されずに回避し、著作権表示をトレーニングデータから意図的に削除したとされる手法の詳細も含まれている。なお、新情報の多くはTimesの訴訟書面から引用されたものであり、元の展示資料は依然として非公開のまま。引用は元の文脈を欠いている点に注意が必要だ。

AI学習における著作権の「フェアユース」該当性については司法判断が続いているが、今月にはTrump政権がOpenAIの著作権未取得利用を支持する意見書を提出している。

स्रोत

techcrunch.com — मूल लेख पढ़ें →