MS幹部、AIスクレイピングを「史上最大の労働搾取」と内部認定
Judul asli: Microsoft exec called AI scraping 'the largest theft of labor in human history'
Mengapa Ini Penting
内部文書がOpenAIのフェアユース主張と正面から矛盾し、業界全体のコンテンツ調達モデルに法的リスクが波及する可能性がある。
NYタイムズ対OpenAI・Microsoft訴訟の非開示解除文書により、Microsoft幹部がAIスクレイピングを「窃盗」と内部発言、OpenAI幹部も出版社への「existential threat」を認めていたことが判明した。
ニューヨーク・タイムズがOpenAIとMicrosoftを相手取り3年前に起こした著作権訴訟で、新たに開示された非秘匿文書が業界に波紋を広げている。Microsoftの幹部はAIの学習データ収集を私的に「窃盗」と表現し、OpenAIのリーダー陣もそのAIモデルが出版社や記者の存立を脅かす「existential threat」であると認識していたとされる。
文書によると、Microsoftの応用科学ディレクター、Brent Hechtが2024年1月に作成した社内プレゼンでは、MicrosoftのCopilotが「answer engine」として機能した結果、NYタイムズへのクリックスルー率が従来のBing検索比で最大93%低下したことが示された。同文書はこの状況を「doom loop」と表現し、「モデル性能とウェブ全体を同時に毀損する」と警告している。
Satya Nadella CEOは今年の証言で、「ペイウォール内のコンテンツはグラウンディングや学習に使用する際にライセンスを取得すべき」と明言。OpenAIがペイウォール後ろのデータをスクレイピングして学習に使用したことを知っていれば、対応が異なったとも示唆した。各社はペイウォールを迂回し、著作権表示を意図的に削除した上でデータを収集したとも指摘されている。なお、非秘匿化されたのはタイムズ側のブリーフが主であり、元の証拠文書は依然として封印されている。