マイクロソフトの応用科学担当ディレクター、Brent Hecht氏は内部文書の中で、他人の著作権コンテンツを許可なく大量に取得してAIを訓練する行為を「人類史上最大の労働窃取」と位置づけた。同じ時期、OpenAIのChatGPT責任者Nick Turley氏は社内通信で、ChatGPTを出版社にとって「存亡に関わる脅威」と表現している。これらの発言は記者によって盗み聞きされたものではなく、マイクロソフト自身が裁判所に提出し、『ニューヨーク・タイムズ』側が法的書類から発見して証拠として提出したものだ。表向きはフェアユース(公正利用)を主張しつつ、社内では窃盗と認める——二つの顔が裁判官の目の前に並べられている。
マイクロソフト応用科学ディレクターの「史上最大の窃取」発言が掘り起こされた
OpenAIとマイクロソフトは法廷の外では一つの話を、社内文書の中では別の話をしている。NYT側は後者を法廷書類から引き出した。
『ニューヨーク・タイムズ』対OpenAI訴訟の証拠開示段階(双方が証拠を交換する手続き)で、新たな文書群が見つかった。マイクロソフトの応用科学担当ディレクターBrent Hecht氏が社内のやりとりで、AI企業が他人の著作権コンテンツを許可なく大量に取得してモデル訓練に使う手法を「人類史上最大の労働窃取」と書き残していた。この四文字をマイクロソフト自身のディレクターが口にしたことの重みは小さくない。
Hecht氏は同じ時期に、さらに具体的な発言もしている。この件は「対象があらゆる国、あらゆる言語、あらゆる分野の人類の労働成果であるため、前例がない」と。
対照が鮮やかだ。同一のマイクロソフトが、対外的にはAI訓練における「フェアユース(公正利用)」の堅固な支持者である一方、社内ではこのビジネスの本質を窃盗だと認めていた。法廷文書がこの二つの顔を裁判官の前に並べている——片方は法務チームの抗弁、もう片方はディレクターが個人的に送ったメールだ。
どちらの発言も社内通信に由来し、被告自身の資料として裁判記録に収められている。否定したければ、自社の文書を先に否定する必要がある。
NYTの弁護士団はさらに7月9日、OpenAIに対する制裁措置をマンハッタンの連邦裁判所に対して単独で申請した。データの破棄処理とChatGPTのログ(ユーザーとAIの対話記録)の問題で、2年にわたって「意図的な妨害」と「虚偽の説明」を続けていると指摘している。
NYT側にとって有利な材料が一つ増えた。マイクロソフトの関係者自身が社内で窃盗を認めたのに対し、被告は法廷でまだ強気に抵抗を続けている。
社内では窃盗と認め、公然とフェアユースを主張する——この溝に整套の抗弁が横たわる
OpenAIが法廷で展開する中核的な抗弁は「フェアユース(公正利用)」だ。訓練データは公開ネットワークから取得しており、原文を直接複製するわけではなく、社会的に価値ある変容的使用(transformative use)に該当するという主張である。しかし同時期に、社内ではこの技術の破壊力を「存亡級」と評価していた。
争点は取得行為の違法性だけではない。被告がリスクを認識しながら、外部では合法と主張していた点にある。今回発見された内部文書の価値は、まさにこの「認識」をテーブルの上に出した点にある。
被告自身、この技術がコンテンツ生産者にとって構造的で不可逆的な打撃になると十分承知していた。それでも表ではフェアユースを主張し、裏ではメディア企業を自社のライセンス契約に素早く囲い込もうとしていた。
AI企業がニュース、書籍、論文を大量に取得してモデル訓練に利用する(膨大なデータを使ってAIに言葉遣いや文章の書き方を学ばせるプロセス)のは、現世代のAI製品に共通する手法である。ただし、業界で広く行われていることは、取得行為が適法である根拠にはならない。
NYT主導のメディア連合が求めているのは、AIを封じ込めることではない。この手法に価格をつけることだ。ライセンス料を払うか、法的責任を負うかのどちらかを迫りたい。訴訟がここまで進んだ以上、証拠の天秤が一寸でも傾けば、影響を受けるのは二社の賠償額だけにとどまらず、将来のすべてのAI製品がコンテンツを取得する手法とコストにも及ぶ。
本当にフェアユースを信じているなら、なぜ社内では「窃取」や「存亡」といった言葉を使うのか?