OpenAI 內部 Lily 項目曝光:人工審核 ChatGPT 用戶聊天記錄以優化大模型

作者:遠洋 責編:遠洋 評論: 9 月 15 日消息,眾所周知,ChatGPT 這類平臺的對話日誌會被用來優化模型。但在此之前,這套處理機制一直是個謎。404 Media 剛剛發佈了一份報道,披露了 OpenAI 對聊天記錄開展人工審核的整套流程,介紹了審核如何運作,以及審核人員有時會讀到用戶私人信息這一情況。OpenAI 內部這項評估項目代號為莉莉計劃(Project Lily)。該媒體獲取到了該項目的操作指引文檔、Slack 工作群組記錄、真實的 ChatGPT 對話樣本,還有用於給對話分級的評分體系。從事這項工作的人員被稱作“提示詞審核員”。
他們的工作內容並不複雜:查看經過匿名化處理的真實用戶聊天記錄,評判 ChatGPT 回覆的質量;評估回答是否切題,同時檢查回覆文本是否過度出現“AI 式話術”、居高臨下的說教語氣、表情符號、諂媚口吻等問題。回覆禁止擬人化表述,也不允許編造“個人經歷”。也就是說,ChatGPT 可以說“我查到了一些相關信息”,但不可以寫成“身為一名廚師,我喜歡……”或者“我明白這種感受”。一名審核員表示,這份工作“十分機械重複”,但時薪據稱超過 50 美元(注:現匯率約合 336.3 元人民幣),對於這樣難度不算高的工作而言報酬相當可觀。
這名審核員還提到,項目的操作指引一直在改動,不同版本之間還經常自相矛盾,多數軟件開發人員應該對此深有體會。但這名工作人員認為,絕大多數用戶並不知道自己的聊天內容會被其他人閱讀。這件事尤其令人擔憂:不少用戶把 ChatGPT 當作臨時傾訴對象、心理疏導對象,向 AI 吐露內心深處的秘密。雖然聊天記錄據稱會先經過一輪匿名處理,審核人員看不到用戶名。但 OpenAI 向 404 Media 承認,過濾環節依然有可能漏掉部分個人數據,簡短會話出現這類問題的概率更高。該媒體還指出,大量對話裡用戶明確請求 ChatGPT 對談話內容予以保密。
交給審核人員的會話版本甚至附帶一份“用戶記憶摘要”,裡面彙總了用戶的提問、興趣偏好、上下文信息,甚至有可能包含位置信息。關鍵點在於:莉莉計劃並不會專門核查回答內容事實上是否準確,僅會標記那些顯而易見的錯誤。這意味著至少還有另外一支(或多支)團隊,在開展獨立的效果評估。同樣,這套評分審核,也和排查用戶是否存在傷害他人(抑或是傷害自身)意圖的人工安全審查屬於兩套獨立流程。該項目的存在也說明,和 AI 公司力圖塑造的公眾印象相反,大模型的迭代進步並不僅僅依靠技術升級與更優質的訓練數據集;依然需要相當數量具備相應能力的人類參與其中。
絕大多數面向普通用戶的聊天機器人都帶有類似設置:“允許使用你的對話記錄改進產品”。幾乎所有聊天產品的該項開關默認都是開啟狀態,不少付費訂閱方案也不例外。不過 ChatGPT 面向企業版、商業版以及教育版客戶時,該項設置默認關閉。但這個切換開關不具備回溯效力。也就是說,已經存入 ChatGPT 數據庫裡的歷史聊天記錄會繼續保留,除非用戶主動申請刪除。另外,刪除操作同樣無法追溯:即便用戶刪除對話,對應的內容或許早已被抓取、完成匿名處理,並留存於某個數據集當中。404 Media 就此發起問詢,一開始 OpenAI 沒有回應:用戶是否被明確告知聊天記錄有可能交由人工審閱。
之後該公司僅提供了一份常見問題頁面鏈接,該頁面提到出於模型優化目的會開展人工審核。經核實,這份公示至少已經存在兩年,實際年限可能更久。在這篇深度報道發佈之後,OpenAI 修改了幫助頁面,補充說明用戶如何選擇退出數據收集;但修改後的文檔當中依舊沒有提及會有工作人員人工讀取會話內容。這類數據收集與人工審閱的做法在各大服務商當中普遍存在。谷歌的 Gemini 就在隱私中心明確寫明“部分保存的聊天記錄可能由人工審核”。Anthropic 也持有相似立場,專門開設網頁說明該事項。而 Perplexity 的態度尚不明確,其隱私政策既沒有確認、也沒有否認工作人員可以訪問聊天日誌。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:ChatGPT,OpenAIOpenAI 聯合創始人布羅克曼:人類已邁入通用人工智能時代OpenAI 進一步完善 ChatGPT Sites:響應速度提升、新增協作功能、可綁定自定義域名OpenAI 將為美國政府機構提供 AI 模型五折優惠,終止每年 1 美元試點項目OpenAI 悄然收緊 ChatGPT 廣告政策,禁止 Adobe 等競品投放 AI 生圖與音頻廣告OpenAI CFO:自研 AI 助力芯片設計,Luna 模型部署成本低於開源方案ChatGPT 捲入校園槍擊案,OpenAI 面臨訴訟數量已超 50 起
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。