OpenAI 旗下負責訓練 ChatGPT 的外判審核團隊,近日被揭發部分人員違規使用 AI 工具完成審核工作,遭公司即時解僱。科技媒體 404 Media 引述內部文件及多名審核員透露,OpenAI 明文禁止審核員評分 ChatGPT 回應時使用任何 AI 工具,一旦被抓到便即時終止合作。

Project Lily 審核制度
OpenAI 早前被揭發推行代號「Project Lily」計劃,聘用數百至逾 10,000 名外判審核員,負責閱讀真實用戶輸入 ChatGPT 的提問及對話內容,再為系統生成的多個回應評分,確保回應不會過度奉承用戶,亦不會令聊天機械人表現得過於人性化。審核員需要先概括用戶意圖,再按 1 至 7 分制,為系統生成的多個回應評分,審視回應是否清晰自然、語氣恰當,同時避免濫用表情符號或「AI 腔」用語。
按 404 Media 取得的內部文件,審核員手冊明確寫明「不要使用 AI 偵測工具,亦不要自己使用 AI」,同時列明審核員不可使用 Grammarly 或 AI 翻譯工具撰寫評語或意見,理由是現有 AI 偵測工具「並不可靠」。文件亦提到,負責監督其他審核員的主管,不應向下屬透露具體偵測 AI 使用的方法,以免對方懂得規避,「要判斷整體模式,而非單一線索」。
多人被踢出項目
負責統籌部分審核員的人力外判公司 Mercor 向 404 Media 證實,一旦確認有審核員使用大型語言模型完成工作,會即時將其移出項目。Mercor 發言人表示:「我們聘用的專家,憑其專業判斷力對推動 AI 發展至關重要,合約嚴格禁止使用 LLM 完成工作,並會投放大量資源偵測濫用情況。」
一名受訪審核員向 404 Media 透露,數千人的審核團隊中,經常有人因使用 AI 完成工作而被解僱,形容這是「最快被踢出項目」的違規行為,「一大群人裡面,已經有很多人被抓到」。另一名被解僱的審核員承認,自己確曾借助 AI 完成部分工作,坦言「只是想輕鬆一點,結果反而害了自己」,並透露終止合約通知書上寫明,公司發現其提交內容的「真確性」出現問題。
主管判斷審核員是否使用 AI 的常見線索,包括用詞重複、過度使用連接號(em dash)等 AI 特有標點風格,以及審核員完成工作的速度異常快。
AI 訓練 AI 的隱憂
業界普遍擔心,AI 模型若持續以 AI 生成內容作訓練材料,可能出現「模型崩壞」(model collapse)現象,即模型表現隨訓練循環不斷惡化。外判審核員的原意正是提供真人判斷,填補缺口,避免 AI 訓練依賴合成數據。假如審核員反過來用 AI 完成評分工作,審核流程的原意便失去意義。
報道亦提到另一名曾為多間 AI 公司做訓練工作的審核員承認,自己曾故意選擇最差劣回應,刻意干擾模型訓練。他形容「一開始確實感到內疚,但後來索性隨機選擇,或者故意選最差答案,感覺自己是拿錢去令 AI 變差」。
審核員酬勞方面,報道指部分審核工作時薪超過 50 美元(約港幣 390 元)。截至報道發布,OpenAI 拒絕就外判審核員被解僱一事回應 404 Media 查詢。
資料來源:404 Media
