快科技9月16日消息,據報道,OpenAI內部存在一個名為Project Lily的項目,僱佣數百名合同工人工審閱ChatGPT用戶的聊天記錄,以此來改進模型回覆質量。
這些合同工被稱為提示詞審核員,工作內容是查看匿名後的真實聊天,評估ChatGPT回覆的質量,判斷是否真正回答了問題,是否存在AI腔調、居高臨下的語氣、表情符號濫用或阿諛奉承。
審核標準明確禁止擬人化表達和編造個人經歷,如ChatGPT可以說「我找到了一些信息」,但不能說「作為一名廚師,我喜歡……」或「我知道那是什麼感覺」。
一位審核員形容工作非常機械,雖然時薪超過50美元,但審核指南經常變動且自相矛盾。

令人擔憂的是,許多用戶會把ChatGPT當作臨時朋友或心理諮詢師,從而在對話中傾吐深層祕密。審核員表示,大多數用戶並不知情自己的聊天正在被他人閱讀。
雖然聊天記錄經過匿名化處理且審核員看不到用戶名,但OpenAI向404 Media承認,這種處理有可能會遺漏掉部分個人信息,短對話尤其容易遺漏。
此外交給審核員的版本還包含一份用戶記憶摘要,匯總了用戶的提問興趣、上下文甚至可能的位置信息。
這一項目也戳破了AI公司的技術形象:模型並非僅靠技術進步和更好的訓練數據提升,仍然需要大量人工介入。
而且大多數聊天機器人會默認啓用「允許使用你的對話改進產品」選項,包括許多付費計劃。已存入數據庫的聊天除非用戶主動刪除否則仍會保留,但即便刪除,聊天可能已被採集和匿名化,存在於某個數據集中。

OpenAI最初對404 Media的詢問沒有回應,後來提供了一條FAQ鏈接,該頁面至少存在兩年,報道發表後OpenAI更新了幫助頁面,但文中未提及人工審核。
Google Gemini在隱私中心則明確表示「人工可能會審閱部分已保存的聊天」,Anthropic也有類似頁面,Perplexity的態度則不明確。