動察 Beating AI 快訊,404 Media 獲得的內部材料顯示,OpenAI 正透過代號「Project Lily」的項目,讓數百名外包人員閱讀真實用戶與 ChatGPT 的對話,用來訓練和改進模型。審核員看不到用戶名,但可能看到完整對話。有些任務還會附上用戶的「記憶摘要」,包括此前聊過什麼、可能住在哪裡等資訊。
這些人會先總結用戶想做什麼,再比較 ChatGPT 生成的多個回答,並按 1 到 7 分打分。審核重點包括事實是否正確、有沒有過度附和用戶,以及 ChatGPT 是否把自己說得太像真人。
OpenAI 會先用 Privacy Filter 去除姓名、聯絡方式等個人資訊,但官方也承認這個模型可能漏掉不常見的身份資訊和模糊的私人資訊。一些敏感內容仍可能出現在審核員面前。
不是所有 ChatGPT 聊天都會被人工閱讀。個人版 Free、Plus 和 Pro 預設開啟「為所有用戶改進模型」,用戶關閉後,新聊天不會再用於訓練;Business、Enterprise 和 Edu 預設不用於訓練。