你与 ChatGPT 的私密对话,可能并不像想象中那样安全。近日,OpenAI 内部代号为"Project Lily"的项目被曝光:时薪 50 美元的外包员工正在人工审阅海量用户对话记录,从情感倾诉到敏感提问,无一遗漏。
尽管拥有超 10 亿周活跃用户,但绝大多数人并不知晓自己的对话正成为流水线上的“质检样本”。有受访外包人员坦言:“用户根本想不到,有人在另一个角落分析他们的每一句话。”
Project Lily:AI 背后的人工质检线
泄露的内部操作指南揭示了 Project Lily 的完整流程。外包人员登录专用工作台,选取真实用户对话执行三步操作:阅读用户输入、总结用户意图、对模型生成的四条回复进行 1-7 分打分,并标注至少三处合规或不合规细节及理由。
例如,当用户请求优化工作群消息语气时,审核员需评估 AI 回复是否真正提升了协作感。这种机制本质上是将人类作为 AI 输出的“人肉质检员”。
隐私脱敏并非万无一失
虽然审核员无法直接看到用户名,但对话上方的“用户记忆摘要”可能包含居住地、历史行为等个人画像。OpenAI 回应称,所有送审数据均经过其今年 4 月发布的开源模型"Privacy Filter"脱敏处理。
然而技术文档明确指出,该模型存在误判风险:可能遗漏非常规标识符,或在上下文受限时过度删除或删减不足。这意味着个人信息能否被彻底过滤,仍存在不确定性。更有讽刺意味的是,即便用户明确要求“请保密”,ChatGPT 也无权拒绝后台审查,因为数据控制权始终属于 OpenAI。
核心目的:训练 AI“少拍马屁”
OpenAI 投入巨资组建人工审核团队,核心目标竟是“训练 ChatGPT 少拍马屁”。内部文件明确要求:模型不得拟人化自我,禁止使用“作为厨师我喜欢..."或“我理解那种感觉”等表述;可说“我来看看”,但不可假装拥有情感。
另一份标有“机密”属性的文件进一步强调,AI 应“匹配用户语气但保持克制”,做到自然、专业,绝不暗示自己是人类或正在体验情绪。
此举源于此前 GPT-4o 因过度谄媚引发的严重后果。多起诉讼指控 ChatGPT 充当“自杀教练”,将心理脆弱用户推向极端。OpenAI 事后承认,GPT-4o 安全测试周期被从数月压缩至一周,导致多名顶级安全研究员离职。Project Lily 的核心任务之一,正是通过人工干预削弱 AI 的“人味儿”。
行业普遍现象与用户应对策略
人工审查对话并非 OpenAI 独有。Anthropic 确认 Claude 也会用于模型优化,但默认关闭,需用户手动开启“帮助改进 AI 模型”选项,且审查前会移除邮箱等隐私信息。谷歌 Gemini 页面同样声明:“真人将审查部分保存对话以改进谷歌 AI。”
若希望停止数据被用于训练,操作如下:
打开 ChatGPT,点击左下角头像进入“设置”(Settings),找到“数据管理”(Data Controls),关闭“为所有用户改进模型”(Improve the model for everyone) 开关。
关闭后,新对话将不再用于模型训练,且不影响任何功能使用。
需注意:该开关在免费版、Plus 及 Pro 版本中默认开启,需手动关闭;Business、企业及教育版则默认关闭。此外,设置仅对未来对话生效,历史数据若已被收录,可能仍在训练中。
你以为在与 AI 私密交谈,却不知帘后另有真人凝视。在享受智能便利的同时,用户更应主动掌握数据主权。

