現地時間12月22日、米国カリフォルニア州北部地区連邦地方裁判所において、注目を集める集団訴訟が正式に提起され、OpenAI、グーグル、Meta、Anthropic、xAI、Perplexity AIの6社が共同被告として名を連ねましたこの訴訟は、ピュリツァー賞を2度受賞したジョン・カレルー氏が主導し、これらのテクノロジー企業が書籍の海賊版を用いて人工知能モデルを訓練し、「意図的な著作権侵害」に当たるとして訴えていますカレルー氏はかつてTheranos社の詐欺事件を暴いたことで知られ、今回は作家らの立場から、知的成果に対する補償の獲得を目指しています
訴状の核心は、被告各社がLibGenやZ-Libraryといった「違法なシャドウライブラリー」から数百万冊もの海賊版書籍を大量にダウンロードし、大規模言語モデルの学習と最適化に利用してきた点にありますこれにより、「海賊版の入手―モデルの訓練―商業的利益の実現」という一連の著作権侵害の連鎖が形成されていると指摘されています原告側は、作家たちの作品が数十億ドル規模のAIエコシステムを支えているにもかかわらず、その対価は一切得られていないと強調しており、陪審員が故意の侵害を認めた場合、作品1件あたり最大15万ドルの損害賠償が請求できるとされています
実は、AI企業が著作権紛争に巻き込まれるのは今回が初めてではありません統計によれば、OpenAIは業界屈指の「訴えられる企業」であり、少なくとも14件もの訴訟に直面しています例えば昨年末には、ニューヨーク・タイムズ紙がマイクロソフトとOpenAIを相手取り、数百万本もの記事をチャットボットの学習に使用したとして提訴し、関連モデルの破棄を求めていましたさらに、グーグルやMetaなども、ディズニーやハリウッドから度々著作権侵害に関する警告を受けていることから、業界全体が海賊版データに依存している実態が浮き彫りになっています
なお、こうした事例には先行例があります今年6月には、Anthropicが海賊版書籍を用いてClaudeモデルを訓練したとして、裁判所から「フェアユース」の適用除外を命じられ、最終的に15億ドルの和解金を支払い、関連データを破棄する結果となりました一方で、xAIやPerplexity AIといった新興企業も、設立から間もないにもかかわらず、今回の訴訟では大手企業と同様の侵害手法が指摘されており、AI産業が抱えるデータソースの課題が改めて浮き彫りとなっています
今回の審理が行われるカリフォルニア州北部地区連邦地方裁判所は、全米のAI関連著作権案件の半数を管轄しており、その判決は学習データの合法性に関する基準を再定義する可能性があります訴訟が進むにつれ、AI大手企業がイノベーションと著作権のバランスをいかに取るかが、業界の将来を左右する重要な鍵となるでしょう