在人工智能大模型飛速迭代的今天,外界普遍認爲技術的進化完全依靠算法升級和龐大的自動化訓練數據。然而,一項最新曝光的內部文件徹底打破了這一公衆印象。據外媒404Media 報道,OpenAI 內部其實長期存在一項代號爲“莉莉計劃”(Project Lily)的人工評估項目,專門安排人類審覈員對 ChatGPT 用戶的真實聊天記錄進行人工審閱與打分。

在這項工作中,被稱作“提示詞審覈員”的工作人員需要查看經過匿名化處理的真實用戶會話樣本,以此評判模型的回覆質量。他們的審覈重點包括評估回答是否切題,以及檢查文本中是否存在過度“AI 化”、高高在上的說教語氣、表情符號或諂媚口吻。值得注意的是,該項目的操作指引嚴格禁止 AI 使用任何擬人化表述或編造“個人經歷”,例如允許說“我查到了一些相關信息”,但不準寫成“身爲一名廚師,我喜歡……”或“我明白這種感受”。雖然工作內容相對機械,但對於難度不高的任務而言,其時薪據稱超過50美元,吸引了不少人蔘與。

然而,這一機制背後隱藏的隱私隱患引發了廣泛擔憂。許多用戶將 ChatGPT 視爲臨時傾訴對象、心理疏導伴侶,向其吐露內心深處的祕密。儘管 OpenAI 宣稱聊天記錄會經過匿名化處理且隱藏用戶名,但該公司也向媒體承認,過濾環節依然有可能漏掉部分個人數據,尤其是簡短的會話出現這類風險的概率更高。更令人意外的是,交到審覈員手上的會話版本中往往附帶一份“用戶記憶摘要”,裏面詳細彙總了用戶的提問、興趣偏好、上下文信息甚至可能包含位置信息。

需要釐清的是,“莉莉計劃”並不會專門覈查模型回答在事實上是否準確,僅會標記出那些顯而易見的錯誤,這意味着效果評估和安全審查通常由其他獨立團隊負責。此外,絕大多數普通聊天機器人都默認開啓了“允許使用你的對話記錄改進產品”這一選項,雖然面向企業、商業及教育版客戶時該設置默認關閉,但手動切換開關並不具備回溯效力。已經存入數據庫的歷史記錄會繼續保留,而即使用戶主動刪除對話,相關內容也可能早已被抓取並匿名化存留在某個數據集中。

面對媒體問詢,OpenAI 最初並未直接回應用戶是否被明確告知聊天記錄可能交由人工審閱,僅提供了一份提及出於模型優化目的會開展人工審覈的常見問題頁面。在這篇深度報道發佈後,OpenAI 悄然修改了幫助頁面並補充了用戶選擇退出數據收集的方法,但修改後的文檔中依然避而不談會有工作人員直接閱讀會話內容的事實。

事實上,這種依賴人工審覈來優化模型的做法在科技行業中並非個例。谷歌的 Gemini 在隱私中心明確寫明部分保存的聊天記錄可能由人工審覈,Anthropic 也持有相似立場並專門開設網頁進行說明,而 Perplexity 的態度則相對模糊,其隱私政策既未確認也未否認工作人員可以訪問聊天日誌。這也表明,在 AI 走向極致智能的道路上,人類的深度參與依然是不可或缺的底層支撐。