「記事を勝手に学習された」——メディアの怒りが訴訟へ
あなたが毎日読んでいるニュース記事が、AIの「教科書」として無断で使われていたとしたら、どう思うだろうか。
アメリカの有力紙シアトル・タイムズと、ニュースデイが、OpenAIとMicrosoftを相手取り訴訟を起こした。
両社は、自社の報道コンテンツがAIモデルの学習に許可なく使われたと主張している。
何が起きたのか
今回の訴訟は、報道機関がOpenAIとMicrosoftを訴える流れの「また一件」として位置づけられる。
シアトル・タイムズとニュースデイは、自社が制作したジャーナリズムの成果物——取材し、編集し、公開した記事——が、生成AIのトレーニングデータとして使用されたと訴えている。
両社の主張の核心はシンプルだ。
「私たちが費用と時間をかけて作ったコンテンツで、あなたたちのAIは賢くなった。それは著作権の侵害ではないか」というものだ。
なぜこれほど訴訟が続くのか——背景にある構造問題
この種の訴訟が相次いでいることには、業界的な背景がある。
大規模言語モデル(LLM)と呼ばれるAIは、インターネット上の膨大なテキストを学習して作られる。
その「テキスト」の中に、新聞・雑誌・ニュースサイトの記事が大量に含まれている可能性があることは、以前から指摘されてきた。
メディア業界にとって、これは二重の打撃だ。
まず、コンテンツが無断で使われたという著作権の問題がある。
さらに、AIが人間の代わりに情報を要約・提供するようになると、ユーザーがわざわざ元の記事を読みに来なくなる——という「トラフィック喪失」の問題もある。
広告収入がPV(ページビュー)に連動する現代のメディアビジネスにとって、後者は死活問題になりうる。
同様の訴訟はすでに複数起きている
この流れは今に始まったことではない。
ニューヨーク・タイムズが2023年末にOpenAIとMicrosoftを提訴したことは特に大きく報じられ、議論の火付け役となった。
その後も複数の報道機関が同様の訴訟を起こしており、今回のシアトル・タイムズとニュースデイはその最新の例となる。
訴訟の数が増えるほど、AI企業側が法的な対応を迫られるプレッシャーも高まる。
一方で、AI企業側は「学習に使うことはフェアユース(公正使用)にあたる」と主張してきた経緯がある。
フェアユースとは、アメリカの著作権法に定められた概念で、一定の条件下では著作権者の許可なくコンテンツを使用できるというものだ。
ただし、これが商業的なAI開発にも適用されるかどうかは、まだ司法の判断が出ていない。
日本のユーザーには関係ない話?
「アメリカの話だから」と流してしまうのは、少し早い。
OpenAIが提供するChatGPTや、MicrosoftのCopilotは、日本でも広く使われているサービスだ。
これらのサービスの根幹にあるAIモデルがどのように学習されたか、という問題は、国境を越えて共通している。
日本でも、著作権法とAI学習の関係は議論の途上にある。
現時点では日本の著作権法はAI学習に比較的寛容な面があるとされているが、今後の法改正や国際的な判例の蓄積によって変わりうる。
こうしたアメリカの訴訟の行方は、日本の制度議論にも間接的に影響を与える可能性がある。
まとめ——「誰がAIを育てたのか」という問い
今回の訴訟で注目すべきは、勝ち負けの予測よりも、「この問いが繰り返し提起されていること」そのものだ。
AIは人間が書いたコンテンツを食べて育つ。
そのコンテンツを作ったのは、記者であり、編集者であり、クリエイターだ。
彼らの労働の対価をどう設計するか——これはAI業界全体が避けて通れない問題になりつつある。
訴訟の結果がどうあれ、「無断学習は当然OK」という前提が揺らいでいることは確かだ。
AIを使う側の私たちも、そのAIが何を学んで賢くなったのか、少し意識してみることが、この問題を自分ごととして考える第一歩になるかもしれない。
出典: Seattle Times and Newsday are the latest publications to sue OpenAI and Microsoft – TechCrunch
