404 MediaがOpenAIの内部マニュアルを入手した。コードネーム「リリー・プロジェクト」と名付けられた人的レビューのパイプラインは、時給50ドルで人を雇い、実ユーザーのChatGPTチャット履歴を一件ずつ読ませ、AIの返答が「お世辞」「説教」「絵文字の乱用」に該当するかを採点させる。さらに厄介なことに、OpenAIは匿名化フィルターが個人データを取りこぼすことを認めており、「ユーザー記憶サマリー」には位置情報まで含まれて審査員の画面に届く可能性がある。あなたが削除した会話は、本当に削除されたとは限らない。

これは心理相談室に入って、秘めた悩みを窓口の「AIカウンセラー」に吐き出し、ドアを閉めれば誰にも聞こえないと思っているのに似ています。ところが帰った直後に、時給50ドルの「品質検査員」があなたの相談室に呼ばれ、さっきのチャット履歴を採点させられます――回答は下手に出ていないか?絵文字が多すぎないか?また「厨师の私が…」のようなキャラクター造形をしていないか?さらに悪いことに、相談室の壁には「この会話はサービス品質の確認に使用される場合があります」との小さな文字が貼ってあり、あなたはそもそも見上げてさえいなかった。ここまでのたとえ話はここまで。実際には、カウンセラーは少なくとも「最近不眠で失業もした」というあなたの発言をそのまま住所つきのサマリーに書き写して隣の見知らぬ人に渡すことまではしないだろう。しかしリリー・プロジェクトのユーザー記憶サマリーには、位置情報すら残っている可能性がある。
事件

時給50ドル、削除した会話を彼らに読まれている

時給50ドルの人間が読んでいるのは、ユーザーがすでに削除したチャット履歴だ。OpenAIの内部コードネーム「リリー」の評価プロジェクトには、ChatGPTの回答が「まともか」を判定する「プロンプト審査員」が配置されている。

従事する彼らは「プロンプト審査員」人間による評価担当者(人的評価者)と呼ばれる。彼らが読むのは匿名化された実ユーザーのチャットで、任務は単純だ――回答が的を射ているか、「AIらしい言い回し」を乱用していないか、上から目線の説教になっていないか、絵文字だらけになっていないか、お世辞を並べていないか。回答は擬人化が禁止され、「厨师(シェフ)である私は……」のようなキャラクター造形はバツ印、「お気持ちは分かります」も不可で、「関連情報を見つけました」とだけ書かなければならない。

複数の審査員によれば、この仕事は「極めて機械的で反復的」だという。さらに彼らを苦笑させるのは、操作マニュアルのバージョン間で矛盾が多いことだ。「多くのソフトウェア開発者なら深く共感するはずだ」と審査員は語る。共感の対象は、開発現場でも日常的に起きる「仕様書が版ごとに食い違う」という状況そのものだ。

$50
審査員の時給(約336元)
出典:404 Media(IT之家経由翻訳)
2年
OpenAIが人間による審査ポリシーを公開してきた期間
出典:404 Media(IT之家経由翻訳)
4項目
採点対象:的確さ、AI口調、説教臭、お世辞度
出典:404 Media(IT之家経由翻訳)
1件
「ユーザー記憶サマリー」には位置情報など機微な文脈が含まれ得る
出典:404 Media(IT之家経由翻訳)

審査員の手元には「ユーザー記憶サマリー」も届く。ユーザーの質問、興味・嗜好、文脈を一括りにまとめたもので、位置情報が付随する場合もある。リリー・プロジェクトはChatGPTの回答が「まともか」だけを扱い、事実の正確性は確認しない――それは別チームの担当。そしてユーザーに害意がないかを調べる安全審査は、さらに別のフローで行われる。

ほとんどのユーザーは自分のチャットを人間に読まれていることを知らない。ChatGPTを日記帳がわり、メンタルケアの相手にしている人も多く、人に言えない胸の内を吐き出している。審査員に渡る版では、ユーザーがChatGPTに「秘密にしてほしい」と明示的に頼んでいるケースがしばしば見られる。

これらの詳細は、404 Mediaが入手した調査資料に基づくものだ――操作マニュアル、内部Slackのやり取り、実会話サンプル、採点基準一式。2026年9月15日にIT之家経由で公開された。

なぜ深刻か

匿名化の崩壊:ユーザー記憶サマリーには位置情報まで画面に残っている

ChatGPTとの会話を削除しても、それは自分のものではない。どこに住んでいるかまで審査員の目に晒されている可能性がある。

審査員の画面に並ぶのは、生の会話ログだけではない。AIが各ユーザーについて自動で書き溜めた「ユーザー記憶サマリー」(AIが各ユーザーについて自動的に作成する「人物プロフィール」で、会話を超えて蓄積され続ける)も一緒に表示される。住んでいるエリア、通っている病院、家族構成——そうした断片がタグとして貼られ、文脈付きで要約に組み込まれていく。

タグは一度付くと、その後の会話すべてにまとわりつく。特定の一つの履歴を削除しても、要約側に接着された断片は残る。消したつもりの会話が、別の場所で審査員の目に触れ続ける仕組みだ。

OpenAIは404 Mediaに対し、匿名化フィルターが一部の個人データを取りこぼすことを認めており、短い会話でこの確率は高くなる。「私は北京市朝陽区の某マンションに住んでいる」や、「某病院で再検査を受けている」といった一言が、会話とともに審査員の画面に滑り込んでいる可能性がある。

リリー・プロジェクトにはもう一つ、分業上の死角がある。チェックしているのは「分かりやすいミス」だけで、事実の正確性は検証せず、ユーザーが他人や自分を傷つける意図を持っていないかも調べない――後者は別の独立した安全チームの管轄だ。モデルにケチをつける人間と、「この会話は危険か」を判断する人間は、別々になっている。AIの回答が誠実でも出鱈目かもしれないし、ユーザーが自殺念慮を吐露している最中かもしれないのに、審査員はただ「減点するか否か」をつけるだけだ。

この仕組みの構造と回避法については、次の節で分解して解説する。