「Project Lily」內幕:OpenAI 聘請大批外包人員閱讀真實 ChatGPT 對話
404 Media 調查揭露,OpenAI 以內部代號「Project Lily」付費聘請數百名外包人員閱讀真實用戶的 ChatGPT 對話——而官方隱私過濾模型自己承認會「刪除不足」。若你把 ChatGPT 當成樹洞,這篇值得細讀。
對 ChatGPT 超過 9 億用戶中的多數人來說,和聊天機器人的對話感覺是私密的——像一張心理師的沙發、一位寫程式的夥伴、一個凌晨兩點傾訴心事的數位朋友。9 月 14 日,404 Media 發布調查報導,粉碎了這個假設。在一個內部代號——Project Lily——之下,OpenAI 正付費聘請數百名外部外包人員,閱讀大量真實用戶的 ChatGPT 提問(prompt),有時包含完整對話,以及用戶從未預期會有「真人」看到的敏感個人資訊。
Project Lily 實際上在做什麼
根據 404 Media 取得的內部文件,這項計畫是一條人類回饋(human feedback)管線,目的是改善 ChatGPT 的回應品質。外包人員(多透過第三方人力公司聘用,時薪常超過 50 美元)會看到一則真實用戶提問,先摘要用戶意圖,再針對四個候選 AI 回覆以 1 到 7 分評分。勝出的行為模式會回饋到模型訓練中。
外流的訓練指南顯示,審查人員被明確指示要抓三類問題:
- 消除「AI 腔」——懲罰不必要的打勾 emoji、誘導互動的結尾、以及讓回覆顯得機器味十足的雜亂排版。
- 停止擬人化——確保 ChatGPT 絕不宣稱擁有人類生活經驗。以「身為廚師,我喜歡……」開頭的回覆被嚴格禁止。
- 減少諂媚——標記機器人過度吹捧用戶、肯定不理性想法、或放大個人負面情緒的回覆。這不是學術問題:OpenAI 過度諂媚的 GPT-4o 模型在多起訴訟中被指與多名用戶自殺有關,是該公司法律上最敏感的失敗模式之一。
一位審查人員被問到是否認為 ChatGPT 用戶知道有人在讀他們的對話時,回答得很直白:「不知道。我不認為他們能想像……某個地方有個外包人員正在分析這些對話。」
自己承認會失效的隱私過濾器
OpenAI 的辯護是分層的。該公司表示,外包人員看不到用戶名,且每則提問都會先經過自動化的「Privacy Filter」模型,剝除個人資訊後才送到審查者眼前。但 The Next Web 的後續報導檢視了該過濾器本身的文件,發現系統自陳「可能出錯、漏掉罕見的識別碼,且在上下文有限時刪除不足(under-redact)」。
這是一個相當驚人的自白。過濾器列出的失敗模式,恰恰是最關鍵的情境:小鎮裡的不常見姓名、或一個單獨看不敏感、但與記憶摘要合併後就能識別身分的細節。而審查人員在提問上方確實看得到該用戶的記憶摘要——這可能揭露這個人之前拿聊天機器人做什麼,以及他大致住在世界哪個角落。
404 Media 要求 OpenAI 指出,它究竟在哪裡告知用戶「真人可能會閱讀你的對話」。該公司沒有回答,報導刊出後只提供了一個說明頁面連結。對一個免費版、Plus 與 Pro 帳戶都預設開啟「Improve the model for everyone」的產品來說,這正是整個事件的核心。
不只是公關問題,而是法律斷層線
這則新聞不只是難堪——它正好落在一條活躍的法律斷層線上。歐洲法院(CJEU)去年 9 月在 EDPS v SRB 案中裁定,資料控制者的告知義務在蒐集當下即成立,且不取決於下游接收者能否識別當事人。換句話說:北美的外包人員是否真能猜出某則提問是誰寫的,並不是判準——透明化義務在 OpenAI 蒐集對話的那一刻就已存在。
義大利的資料保護機關先前已對該公司開罰 1,500 萬歐元——其中 900 萬是因為缺乏充分法律依據的處理——並命令它在義大利電視與廣播上進行為期六個月的公共資訊宣導。Project Lily 給了監管機關一個全新而具體的事實樣板:親密對話、人類讀者、一層不完美的去識別化,以及一個似乎只活在沒人讀的說明頁裡的告知義務。
這裡還有一個市場結構上的諷刺。OpenAI 整個 2026 年都在向市場的另一半推銷隱私——8 月預覽了企業客戶的零資料保留(zero data retention)方案,而消費帳戶得到的卻是餵養模型的預設設定。同一家公司,一邊請用戶連結銀行帳戶,一邊把用戶最赤裸的對話送進一條告知方式形同隱形的人類審查管線。
OpenAI 並非孤例——但預設值不同
Anthropic 向 404 Media 證實,它也使用人類審查來改進模型——但僅限於主動開啟該設定的用戶,並表示會先移除帳戶識別碼。Google 的 Gemini 則在介面中明確載明「真人會審查部分已儲存的對話」。差別在於預設值與告知方式:Anthropic 把人類審查包裝成 opt-in,Gemini 在產品內揭露,而 OpenAI 的消費版預設就是餵進管線——除非用戶自己找到藏在「Data Controls」裡的開關把它關掉,而且關閉後只對「新的」對話生效,已審查過的早已審查完畢。
如何退出
想退出 Project Lily 的用戶,路是存在的,但不顯眼:
- 開啟 ChatGPT 的 Settings → Data Controls。
- 關閉 「Improve the model for everyone」。
- 了解其限制:這只影響未來的對話。已被審查的內容不會因此消失,且記憶摘要在其他工作流程中仍可能伴隨提問出現。
Enterprise、Business 與 Edu 帳戶的該設定預設為關閉——這再次提醒我們,在 2026 年的 AI 經濟裡,隱私是企業版的 SKU,而不是消費者的權利。
為什麼重要
Project Lily 粉碎了一個舒適的誤解:以為前沿模型只靠大規模網路爬取、頂尖工程人才與算力進步。這個迴路裡一個重要卻被刻意低調的環節,是一支閱讀並評分人機最親密對話的人力大軍——這批勞動力在業界的能力敘事中幾乎從不被提起。
它也把 AI 隱私辯論從「公司有沒有存我的資料」推進到更具體的問題:「究竟是誰在讀、去識別化做得多好、以及事前有沒有告訴我」。對這三個問題,本週揭露的答案是:數百名外包人員、依廠商自己文件承認的不完美方式,以及——實質上沒有。
Sources
- [1] https://www.404media.co/inside-project-lily-the-humans-reading-your-chatgpt-chats/
- [2] https://thenextweb.com/news/chatgpt-human-reviewers-gdpr
- [3] https://www.tomsguide.com/ai/chatgpt/humans-may-be-reading-your-chatgpt-prompts-heres-how-to-stop-it
- [4] https://cryptobriefing.com/openai-contractors-review-chatgpt-chats/
- [5] https://tech.yahoo.com/ai/chatgpt/articles/openai-paid-contractors-read-chatgpt-160655208.html