Microsoft、侵害告発に反論:Copilotがニューヨーク・タイムズ紙や著者の著作物のコンテンツを複製することはほとんどない

📅 2026-09-05

要約:

ニュース出版社と本の著者による共同著作権侵害訴訟に応じて、マイクロソフトは最新の弁護資料を裁判所に提出し、同社の人工知能チャットボット Copilot は、ニューヨーク タイムズなどのメディアからの報道や著作権で保護された文学作品を逐語的にコピーしたり、実質的に複製したりすることはほとんどないと主張しました。この姿勢は、MicrosoftとOpenAIに対する強固な「フェアユース」法的弁護を構築し、裁判所に関連訴訟をできるだけ早く略式判決で終わらせるよう促すことを目的としている。

訴訟の証拠開示プロセスの一環として、マイクロソフトは、原告の報道機関が雇った専門家に、実際の副操縦士の会話の 820 万件のトランスクリプトのデータベースを公開しました。 Microsoftは、データセットは無作為に選択されたものではなく、原告のニュースWebサイトに関連するキーワードに基づいて特別に選別されたと指摘した。理論的には、これは「侵害の疑いのあるコンテンツが含まれている可能性が最も高い」サンプル セットです。

しかし、データ分析の結果、繰り返し頻度が非常に低いことが判明しました。これら 820 万件のフィルター処理されたレコードのうち、モデルのトレーニングに使用されたニュース コンテンツと重複する少なくとも 16 個の連続した単語を含むレコードは 59,545 件のみであり、レコード全体の 1% 未満にすぎません。さらに、非営利の調査報道団体「Center for Investigative Reporting」(調査報道センター)が関与した訴訟では、元の専門家が同団体の資料と「実質的な重複」を構成する膨大なサンプルの中から特定したのは51件のみだった。

書籍の著作権をめぐって作家グループが起こした別の統合訴訟でも、テストデータは同様の傾向を示しました。原告の作家に雇われた独立した専門家は、この訴訟に関係した212冊の書籍のレビューを実施し、最終的に、少なくとも30語の重複がある生成されたレコードを発見したのはわずか10冊の書籍で、そのような一致するサンプルは合計で24件のみでした。

Microsoft は法廷で、これらの詳細なデータは、同社の中核となる法的防御、つまり著作権で保護された素材を使用して大規模な言語モデルをトレーニングすることは、米国著作権法の枠組みに基づく「フェアユース」であることを確認しただけであると主張しました。 Microsoftは、Copilotとその背後にある生成AIシステムが著作権で保護された素材を使用する目的は、元の出版物の目的とは根本的に異なると強調した。その基本的なメカニズムは、元の作品の代替物として流通するのではなく、言語パターンを吸収して再編成して新しいコンテンツを生成することです。たとえ散発的なテキストの断片が時折再発したとしても、大規模な言語モデルのトレーニング プロセスの「変容的な使用」特性を消去することはできません。

以前、ニューヨーク・タイムズ、調査報道センター、作家ギルドなどの多数のメディア組織やクリエイター・グループが共同で訴訟を起こし、マイクロソフトとOpenAIが商用AIプラットフォームをトレーニングするための許可なく何百万ものオリジナルの記事や書籍を違法に入手し、高度に重複するコンテンツを生成することで原作者と直接競合し、独立系ジャーナリズムや文学創作のビジネス・エコシステムに深刻な影響を与えているとして告訴した。司法手続きの効率化を図るため、ニュース出版社やライターが関与した関連訴訟は統合され、同じ連邦判事に引き渡された。

現在、マイクロソフトは正式に略式判決を裁判所に申請しており、原告の実質的な侵害告発には普遍的な事実根拠が欠けていることを証明するために上記のデータを使用することを期待しており、それによって、生成型人工知能の基礎となるトレーニングの合法性に関するこの主要な業界訴訟を早期に解決したいと考えています。現時点では、ニューヨーク タイムズ、調査報道センター、および全米脚本家組合は、マイクロソフトが提出した最新の統計および法廷陳述について公式にコメントしていません。

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし