
News Observation Lab for Future
マイクロソフトとOpenAIのAI学習が労働を奪うと指摘された訴訟の概要

訴訟の概要と発端
木曜日に公開された92ページの要旨は、マイクロソフトの応用科学部門ディレクターであるブレント・ヘクト博士のコメントを二度引用しながら始まります。ヘクト氏は、AI が「前例のない規模の驚くべき窃盗」、さらには「人類史上最大の労働力の窃盗」となると警告しています。
原告側の主張と関係者
ニュース原告らの統合略式判決準備書面は、OpenAI 著作権訴訟の統合訴訟としてシドニー・H・スタイン判事に提出されました。編集されていないバージョンを発見したデジタル・コンテンツ・ネクストのジェイソン・キント氏や、複数のメディア(Financial Times、Washington Post、404 Media、New York Times など)が本件を報じています。また、Daily News Group や調査報道センター、CNET、ZDNet、PCMag、Mashable、Ziff Davis も原告に含まれています。
マイクロソフト内部資料の指摘
マイクロソフト独自の数値に基づく「破滅ループ」の概念が文書で示されています。AI コンテンツ戦略が自社モデルとウェブ全体に損害を与えるとされ、クリックスルー率は Times のウェブサイトで 87%〜93%、Daily News Group で 83%〜91%、Ziff Davis で 51%〜94%に低下したと報告されています。ヘクト氏は、システムがトレーニングデータのパターンを複製することで機能し、経済価値をサプライチェーンに戻す方法はないと指摘し、コンテンツ制作者の経済的安定を脅かすと述べています。
OpenAI の内部警告とデータ規模
OpenAI の研究担当副社長は、ネットワークが訓練データを記憶することが目的であると説明し、2019年11月までに著作権で保護された作品の再生成物に対する社内懸念があったことを明らかにしました。中間トレーニングデータセットには原告の著作物が 91,692 件以上含まれ、WebText2 には Times 紙から 6,552 件、Daily News Group から 18,609 件、Ziff Davis から 66,780 件が掲載されています。さらに、1987 年から 2007 年までの 180 万件超の記事からなる New York Times Annotated Corpus が非営利研究向けライセンスで取得されています。
政府・裁判所の見解
米国政府は、著作権で保護されたテキストのトレーニングはフェアユースであると主張し、トレーニングと出力は別の用途であると説明しています。また、ライセンスを独占禁止法の観点から問題視し、大手テクノロジー企業だけが料金を支払える状況が「古い主流メディア企業への多額の補助金」になるとの指摘があります。
今後の展望
スタイン判事は、AI 学習が「変革的」であるか否か、そしてそれが著作権上の窃盗に該当するかを判断する略式判決の判決待ちです。欧州ブリュッセル市は、Google の AI オプトアウトが機能するか出版社に問い合わせる姿勢を示し、米国政府はそれを独占禁止法違反と位置付けています。
元記事: https://thenextweb.com/news/microsoft-theft-of-labor-doom-loop-unsealed-brief-openai