
最近、ニューヨーク・タイムズが公開した法的文書によると、マイクロソフトの応用科学部門ディレクターであるブレント・ヘックト氏は社内メモの中で、AIモデルの学習を「人類史上最大規模の労働の窃盗」と位置づけ、「前例のない規模で衝撃的な窃盗行為だ」と述べています。
ヘックト氏は2023年1月の社内メモで次のように記しています。「世界中の何百万人もの人々が、大規模なモデルが自分たちの作品をすべて吸い取ってしまうことを、前例のない規模の驚くべき窃盗とみなすようになるでしょう……自分の創作したコンテンツがこのような形で利用されることを望んでいる人はほとんどいませんし、その対価も得ていません。」
また、2024年1月付の別の社内プレゼン資料では、ヘックト氏はAIが報道業界に与える影響を「破滅のループ(doom loop)」と表現しました。AI製品がニュースサイトのトラフィックと収益を絶えず減少させることで、報道機関はコンテンツ制作を縮小せざるを得なくなり、最終的にはAIモデル自身も信頼できる情報源を失ってしまうというのです。「末端の製品がその中核となる供給者の経済基盤を脅かすというのは極めて異例のことですが、それこそが私たちがLLM事業において作り出している状況なのです」と、ヘックト氏は文書の中で述べています。
ヘックト氏の発言が公になったことを受け、マイクロソフトの広報担当者は「ヘックト氏のコメントはあくまで個人の見解であり、法的な分析でも会社の立場を示すものでもありません」と述べました。同時に、同社は自社のAI製品が「変容性のあるフェアユース」に該当し、ニュースサイトの代替にはならないと主張しています。
この事件の核心的な意義は、AI業界における学習データの著作権問題をめぐる公的な立場と内部での認識との間に大きな隔たりがあることを浮き彫りにした点にあります。
AI企業は公には、自社の学習データが「フェアユース」の原則に適合しており、報道機関の権利を侵害していないと強弁しています。しかし、社内文書からは、マイクロソフトの応用科学部門ディレクターやOpenAIのChatGPT責任者といった幹部たちが、商業用AI製品の訓練のために大量のニュース記事を収集する手法について、倫理的に正当化しがたく、市場においてコンテンツ制作者に実質的な損害をもたらしていることを、すでに私的に認識していたことが明らかになっています。
現在、2023年に始まったこの著作権訴訟は依然として進行中で、裁判官は2027年までに本件を審理段階へ進めるかどうかを決定する予定です。ヘックト氏の社内メモの公開は、原告側の主張にとって、被告側内部からのこれまでで最も直接的な証拠となっています。