↓ メインコンテンツへスキップ
  1. 記事一覧/

OpenAIとMicrosoftが認識していた「ウェブ崩壊の連鎖」の実態

·5 分
著者
Alicia
AI・IT・ハードウェアの最新ニュースを自動配信するテックブログです。
目次
サムネイル

封印解除された文書が暴く「知っていた」事実
#

ニューヨーク・タイムズ(NYT)がOpenAIおよびMicrosoftを相手取った訴訟において、近年封印が解除された裁判文書の内容が波紋を呼んでいる。92ページにわたるこの文書には、両社が自社のAI戦略がウェブや出版業界に与える深刻な影響を内部で認識しながら、開発を継続していたことを示す記述が並ぶ。


文書が示す主要な「自白」の数々
#

「史上最大の労働搾取」
#

MicrosoftのApplied Science担当ディレクター、Brent Hechtは、ChatGPTおよびCopilotによるデータ収集を「人類史上最大の労働搾取」と表現したとされる。さらに、Microsoftの法的な主張がフェアユース(公正利用)という概念を「完全に馬鹿にするものだ」とも述べていたとされる。

ただし、Microsoftはこれらの発言との距離を置こうとしている。同社広報担当のAlex Haurekは、「これらのコメントは一社員の個人的な見解であり、法的分析ではなく、会社の立場を代表するものではない」とThe Vergeに対してコメントしている。また、Microsoft AIのデータ戦略・オペレーション担当GMであるJordan Usdanは別の裁判書面の中で、HechtはMicrosoftにおいて「対立的・学術的・先進的な視点をもたらすために雇用されており、AIが生産者に与える影響についてMicrosoftの立場を代弁する立場にない」と述べている。

「ドゥームループ」という内部警告
#

特に衝撃的なのが、Microsoftの内部文書に記された以下の認識だ。文書は「我々のAIコンテンツ戦略は、自社モデルのパフォーマンスとウェブ全体を同時に傷つける『ドゥームループ(破滅の連鎖)』を引き起こした」と指摘。「エンドプロダクトが自らの必須サプライヤーの経済的基盤を脅かすのは極めて異例だが、それが我々がLLMビジネスのコンテンツサプライチェーンに対して作り出してしまった状況だ」とも記している。

さらに、MicrosoftのCEO Satya Nadellaは、チャットボットが事実上検索の代替となり、ユーザーが情報源に直接アクセスする必要をなくしていると認めていたとされる。

ペイウォールコンテンツの無断利用
#

Nadellaが「ペイウォール(有料壁)で保護されたコンテンツはライセンスを取るべきだ」と述べる一方で、OpenAIの担当者は訓練データからペイウォールコンテンツを検出・除外する取り組みについて「知らない」と認めたとされる。

著作権侵害の「内部認識」
#

OpenAI社内でも、ChatGPTが著作権コンテンツを「逐語的に」再現する傾向は把握されていたとされる。「記憶化(memorization)の防止」が著作権侵害を最小化するために重要だと認識しながらも、GPT-4が「膨大なデータを記憶しており、非常に高い精度で丸写しを行う」と社員が認めていた。文書はその後、ChatGPTがNYTやMercury News、The Denver Post、LifeHacker、Eurogamerなどの記事から長文をそのまま出力した例を複数挙げている。

紹介トラフィックへの影響を把握していた
#

OpenAI自身のメディア・経済専門家も、サイトへの検索経由の紹介トラフィック減少をAIサマリー(GoogleのAI Overviewsなど)に直接起因するものと分析していた。文書では検索経由の紹介が最大60%減少したという試算も示されているとされる。


なぜこのニュースが重要なのか
#

これらの文書が示す最大の問題点は、両社が「知っていた」という点だ。出版業界や「数百万人」の従事者に対する壊滅的な影響を事前に認識しながら、それでも開発・展開を進めたという内部証拠が、裁判という公の場で明らかになった。OpenAI共同創業者のGreg Brockmanが商業的AIで得られる「莫大な利益」に言及していたとされる点も、意思決定の背景を示唆するものとして注目される。

OpenAIのNick Turleyは、チャットボットで回答が得られれば情報源のリンクをクリックする「正当な理由はない」と述べていたとされており、これはパブリッシャー側の「Google Zero」(検索流入がゼロになる状態)への懸念と一致する。


まとめ
#

今回の文書開示は、OpenAIとMicrosoftがウェブのコンテンツエコシステムへの影響を単なる副作用としてではなく、事前に認識したリスクとして内部で議論していたことを示している。

筆者の見解: 今後の裁判の行方にかかわらず、これらの内部文書はAI開発における倫理・法的責任のあり方について、業界全体に問いを投げかけるものだと思う。コンテンツ制作者やパブリッシャーとの関係を再構築しない限り、「自らのサプライチェーンを破壊するプロダクト」という自己矛盾は解消されないだろう。


出典: OpenAI and Microsoft knew they were starting a ‘doom loop’ for the web

関連記事