科技媒體 404 Media 調查揭露,OpenAI 內部一個代號「Project Lily」(百合計劃)秘密項目,聘用數百名外判合約工人,逐條閱讀真實用戶與 ChatGPT 對話,協助訓練及改善模型回應。報道指這些對話有時包含用戶敏感個人資料,而 ChatGPT 超過 9 億名用戶當中,大部分未必意識到自己對話有機會被真人審核員閱讀。

三階段審核流程曝光
404 Media 取得內部檔案及真實審核畫面顯示,審核員工作分為三個階段:先閱讀一條真實用戶提問,撰寫簡短摘要概括用戶意圖,再為 4 個 ChatGPT 生成回應以 1 至 7 分評分,並解釋評分原因。404 Media 引述內部指引原句指,「一個優秀回應應該理解用戶意圖,提供有用而準確協助,並以清晰、自然風格書寫」,審核員被要求引導模型回應變得「有用、誠實真確、具賦權作用」,同時盡量減少奉承(sycophancy)及模型自我擬人化傾向。
審核員畫面上方亦會顯示一份「用戶記憶摘要」(user memories summary),有時可以看到用戶過往用途,甚至大致所在地區,即使用戶名稱本身不會顯示。
招募與薪酬架構
外判工人透過招募平台 Crossing Hurdles(口號為「連接技術人才與 AI 工作未來」)應徵,實際薪酬經 AI 訓練公司 Mercor 發放。一名北美地區審核員向 404 Media 透露,時薪超過 50 美元(約港幣 390 元)。
一名參與審核工作人士被問到用戶是否知道有真人閱讀其對話時回答:「不,我不認為他們會想像到,有某個外判工人正在分析對話內容。」
私隱過濾器承認有漏洞
OpenAI 回應指審核員看不到用戶名稱,對話送到審核員前會先經過一個「私隱過濾器」(Privacy Filter)模型處理,期望可以移除個人身份資料。不過公司亦承認過濾器並非百分百準確,敏感細節仍有機會漏過,直接送到人手審核員眼前。
Anthropic 已向 404 Media 確認同樣有使用人手審核方式改善 Claude 模型回應,做法是先剔除電郵地址等帳戶資料才交由審核員查閱。Google Gemini 亦在私隱聲明中提及,真人可能會審核用戶已儲存對話。
披露方式引爭議 用戶如何設定
404 Media 向 OpenAI 追問公司在哪裡明確告知用戶有真人審核對話,起初未有正面回應。目前 OpenAI 只在一個常見問題頁面中提到,獲授權人員及服務供應商可能查看用戶資料以改善模型表現,並提醒用戶不要輸入敏感資料,而這段聲明自 2023 年在網上推出以來只作輕微修改。404 Media 認為,「改善模型給所有人」(Improve the model for everyone)設定名稱聽起來更似友善社群貢獻,而非同意讓真人閱讀自己對話授權。
用戶如想停用人手審核,可在帳戶設定內「資料控制」(Data Controls)選項,關閉「Improve the model for everyone」,或透過私隱入口網站選擇「不要用我的內容訓練」(do not train on my content),兩者做其一即可,毋須同時操作。不過要留意,關閉設定只會影響之後新對話,不會追溯移除已有紀錄;若用戶在關閉設定後仍就某段對話提供意見反饋(feedback),整段對話仍有可能被用作訓練模型。
企業、商業及教育帳戶(ChatGPT Enterprise、Business、Edu)連同 API 平台則屬預設不用作模型訓練,毋須額外設定。
訓練目標與過往爭議
內部檔案顯示,「百合計劃」訓練重點之一是減少 ChatGPT 過度奉承(sycophancy)傾向,以及避免模型過度擬人化,聲稱自己有情感或意識。404 Media 指出,這與 OpenAI 早前 GPT-4o 模型過度奉承問題有關,多宗訴訟指該問題一定程度上涉及多名用戶自殺事件,是 OpenAI 需要正視重要問題。
資料來源:404 Media
