一句话看懂:据 404Media 报道,OpenAI 内部存在一个名为 “Project Lily” 的项目,由人类审核员查看 ChatGPT 用户的真实聊天记录,用于评估模型回答质量。这暴露出一个被多数用户忽略的事实:你与 AI 的私密对话,可能正被人阅读。
事件核心:发生了什么
根据海外媒体 404Media 的报道,OpenAI 长期运行一个内部代号为 “Project Lily” 的项目。参与其中的员工被称为 “prompt reviewers”(提示审核员),他们的工作是查看经过匿名化处理的真实用户对话样本,评估模型回复的质量——重点包括回答是否切题、语气是否过于 “AI 化” 或居高临下、是否滥用表情符号或谄媚表达。
项目指南明确禁止模型使用拟人化表达或编造 “个人经历”,例如可以说 “我找到了一些相关信息”,但不能写 “作为一名厨师,我喜欢……”。据称这类工作难度不高,时薪超过 50 美元。
更值得关注的是隐私层面。OpenAI 声称聊天记录已匿名化、隐藏了用户名,但也向媒体承认过滤流程可能遗漏部分个人信息,短对话尤其容易出问题。交给审核员的对话版本中,往往还附带一份 “用户记忆摘要”,包含用户的问题、兴趣、上下文甚至位置信息。此外,普通用户账户默认开启 “允许使用你的对话记录改进产品” 选项,即便事后关闭,该设置也不具备追溯效力;即使主动删除对话,内容也可能早已被收集、匿名化并进入某个数据集。
为什么重要
这则报道的价值不在于 “AI 公司用人工审核” 本身——Google 的 Gemini 在隐私中心明确说明部分聊天记录可能被人工查看,Anthropic 也有专门页面解释类似做法,Perplexity 则态度模糊。真正关键的是信息透明度:OpenAI 在被问及是否明确告知用户聊天记录可能被人工审核时,最初并未直接回应,仅提供了一个提到 “为模型优化进行人工审核” 的 FAQ 页面。报道发布后,OpenAI 悄悄更新了帮助页面,增加了用户退出数据收集的方法,但修订后的文档依然回避了 “员工直接阅读对话内容” 这一事实。
在大模型依赖海量自动化训练数据的叙事之外,人工审核仍是模型优化不可或缺的底层环节。但当用户把 ChatGPT 当作倾诉对象时,这种 “人在环中” 的机制就与隐私预期产生了直接冲突。
对用户/开发者/创作者的影响
对普通用户而言,最实际的动作是检查账户中的 “改进模型” 数据开关。需要明确的是,关闭开关无法撤回已被收集的历史记录。对开发者和企业采购方来说,企业版、商业版和教育版默认关闭数据收集,这构成了合规采购时的一个现实考量点,但同样要注意开关不具备追溯性。对内容创作者而言,如果曾将未公开的创意、稿件或个人经历输入 ChatGPT 寻求帮助,应假设这些内容存在进入内部数据集、被匿名化处理后被人工审阅的可能。目前公开信息显示,Project Lily 并不专门核查回答的事实准确性,只标记明显错误,有效性评估和安全审查由其他独立团队负责。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 OpenAI 后续帮助文档是否会更直接地披露人工审核的具体范围与流程;二是其他提供类似人工审核机制的厂商,是否会跟进调整隐私说明的措辞;三是 “用户记忆摘要” 这类附带信息的处理方式是否会有独立说明或管控选项。这些变化将直接影响用户对 AI 产品隐私边界的判断。
来源:AIbase


