404 MediaがOpenAIの内部マニュアルを入手した。コードネーム「リリー・プロジェクト」と名付けられた人的レビューのパイプラインは、時給50ドルで人を雇い、実ユーザーのChatGPTチャット履歴を一件ずつ読ませ、AIの返答が「お世辞」「説教」「絵文字の乱用」に該当するかを採点させる。さらに厄介なことに、OpenAIは匿名化フィルターが個人データを取りこぼすことを認めており、「ユーザー記憶サマリー」には位置情報まで含まれて審査員の画面に届く可能性がある。あなたが削除した会話は、本当に削除されたとは限らない。
時給50ドル、削除した会話を彼らに読まれている
時給50ドルの人間が読んでいるのは、ユーザーがすでに削除したチャット履歴だ。OpenAIの内部コードネーム「リリー」の評価プロジェクトには、ChatGPTの回答が「まともか」を判定する「プロンプト審査員」が配置されている。
従事する彼らは「プロンプト審査員」人間による評価担当者(人的評価者)と呼ばれる。彼らが読むのは匿名化された実ユーザーのチャットで、任務は単純だ――回答が的を射ているか、「AIらしい言い回し」を乱用していないか、上から目線の説教になっていないか、絵文字だらけになっていないか、お世辞を並べていないか。回答は擬人化が禁止され、「厨师(シェフ)である私は……」のようなキャラクター造形はバツ印、「お気持ちは分かります」も不可で、「関連情報を見つけました」とだけ書かなければならない。
複数の審査員によれば、この仕事は「極めて機械的で反復的」だという。さらに彼らを苦笑させるのは、操作マニュアルのバージョン間で矛盾が多いことだ。「多くのソフトウェア開発者なら深く共感するはずだ」と審査員は語る。共感の対象は、開発現場でも日常的に起きる「仕様書が版ごとに食い違う」という状況そのものだ。
審査員の手元には「ユーザー記憶サマリー」も届く。ユーザーの質問、興味・嗜好、文脈を一括りにまとめたもので、位置情報が付随する場合もある。リリー・プロジェクトはChatGPTの回答が「まともか」だけを扱い、事実の正確性は確認しない――それは別チームの担当。そしてユーザーに害意がないかを調べる安全審査は、さらに別のフローで行われる。
ほとんどのユーザーは自分のチャットを人間に読まれていることを知らない。ChatGPTを日記帳がわり、メンタルケアの相手にしている人も多く、人に言えない胸の内を吐き出している。審査員に渡る版では、ユーザーがChatGPTに「秘密にしてほしい」と明示的に頼んでいるケースがしばしば見られる。
これらの詳細は、404 Mediaが入手した調査資料に基づくものだ――操作マニュアル、内部Slackのやり取り、実会話サンプル、採点基準一式。2026年9月15日にIT之家経由で公開された。
匿名化の崩壊:ユーザー記憶サマリーには位置情報まで画面に残っている
ChatGPTとの会話を削除しても、それは自分のものではない。どこに住んでいるかまで審査員の目に晒されている可能性がある。
審査員の画面に並ぶのは、生の会話ログだけではない。AIが各ユーザーについて自動で書き溜めた「ユーザー記憶サマリー」(AIが各ユーザーについて自動的に作成する「人物プロフィール」で、会話を超えて蓄積され続ける)も一緒に表示される。住んでいるエリア、通っている病院、家族構成——そうした断片がタグとして貼られ、文脈付きで要約に組み込まれていく。
タグは一度付くと、その後の会話すべてにまとわりつく。特定の一つの履歴を削除しても、要約側に接着された断片は残る。消したつもりの会話が、別の場所で審査員の目に触れ続ける仕組みだ。
OpenAIは404 Mediaに対し、匿名化フィルターが一部の個人データを取りこぼすことを認めており、短い会話でこの確率は高くなる。「私は北京市朝陽区の某マンションに住んでいる」や、「某病院で再検査を受けている」といった一言が、会話とともに審査員の画面に滑り込んでいる可能性がある。
リリー・プロジェクトにはもう一つ、分業上の死角がある。チェックしているのは「分かりやすいミス」だけで、事実の正確性は検証せず、ユーザーが他人や自分を傷つける意図を持っていないかも調べない――後者は別の独立した安全チームの管轄だ。モデルにケチをつける人間と、「この会話は危険か」を判断する人間は、別々になっている。AIの回答が誠実でも出鱈目かもしれないし、ユーザーが自殺念慮を吐露している最中かもしれないのに、審査員はただ「減点するか否か」をつけるだけだ。
この仕組みの構造と回避法については、次の節で分解して解説する。