據404Media調查,OpenAI僱傭數百名合同工審覈真實ChatGPT用戶對話,以改進模型回覆質量。泄露的內部文件及消息人士顯示,審覈人員會對ChatGPT生成的回覆按1至7分進行評分,重點幫助減少模型過度奉承及過度擬人化等問題。
部分評論員認爲,用戶並不清楚自己的聊天記錄可能被真人閱讀;經匿名化處理的對話中仍可能包含敏感個人信息,OpenAI雖部署隱私過濾器,但也承認其可能出現誤判。

據報道,這些合同工由Crossing Hurdles招募,並由AI培訓公司Mercor支付薪酬,一名北美地區評論員稱其時薪超過50美元。OpenAI目前默認開啓“爲所有人改進模型”設置,用戶可關閉該選項,阻止新創建的聊天記錄用於模型訓練及相關人工審覈;臨時聊天模式則不會使用輸入數據訓練模型。
值得注意的是,OpenAI並非近期才披露人工審覈機制。其FAQ至少自2023年起就說明,授權人員及服務提供商可能查看用戶數據以提升模型性能,並建議用戶不要輸入敏感信息。404Media認爲,這一披露較爲隱晦,用戶可能難以直觀理解人工審覈的實際範圍。
人工反饋已成爲大模型優化的重要環節。Anthropic也確認會對啓用相關隱私設置的Claude對話進行人工審覈,並在審覈前進行匿名化處理;谷歌同樣允許人工審覈員檢查部分Gemini聊天記錄。此次事件再次凸顯AI模型訓練效率與用戶數據隱私之間的平衡問題。
VIP會員