一句话看懂:404 Media 披露 OpenAI 内部代号“莉莉计划”的人工评估流程:审核员会阅读经匿名化处理的真实 ChatGPT 对话,评判模型回复质量。值得关注的是,匿名化并不总能过滤掉个人信息,而不少用户把 ChatGPT 当作倾诉对象。
事件核心:发生了什么
据 IT之家 9 月 15 日援引 404 Media 报道,OpenAI 内部有一项代号为“Project Lily(莉莉计划)”的评估项目。404 Media 获取了该项目的操作指引、Slack 工作群记录、真实对话样本以及一套对话分级评分体系。从事这项工作的人被称为“提示词审核员”,职责是查看匿名化后的用户聊天记录,评估 ChatGPT 回复是否切题,并检查是否过度出现“AI 式话术”、说教语气、表情符号和谄媚口吻;回复也被禁止拟人化,不允许编造“个人经历”。一名审核员称工作“十分机械重复”,但时薪超过 50 美元(约合 336 元人民币),且操作指引版本频繁改动、时常自相矛盾。
关键在于数据边界:聊天记录虽先经匿名处理,OpenAI 也向 404 Media 承认过滤环节可能漏掉部分个人数据,简短会话概率更高;交给审核员的版本还附带“用户记忆摘要”,汇总提问、兴趣偏好、上下文,甚至可能含位置信息。报道还指出,莉莉计划不专门核查回答的事实准确性,只标记明显错误,事实评估与安全审查属于另外的独立流程。
为什么重要
这套机制揭示了一个被产品叙事淡化的现实:大模型迭代不只依赖算力和更优训练数据集,仍需要相当规模的人类参与打分和反馈,属于典型的 RLHF/人类反馈环节。更重要的是合规与信任问题。ChatGPT 的“允许使用对话记录改进产品”默认开启,企业版、商业版、教育版则默认关闭;但开关没有回溯效力,历史对话除非用户主动申请删除否则继续保留,而删除也无法追溯已经抓取、匿名化并进入数据集的内容。OpenAI 起初未正面回答用户是否被明确告知人工审阅,仅提供常见问题链接;报道发布后修改了帮助页面补充退出数据收集的方式,但修改后的文档仍未提及工作人员会人工读取会话。横向看,谷歌 Gemini 隐私中心写明部分聊天记录可能由人工审核,Anthropic 也有专门说明,Perplexity 态度不明确。
对用户/开发者/创作者的影响
对普通用户,最实际的动作是检查账号里的数据改进开关,敏感内容尽量不要输入,删除历史对话并不能撤回已被纳入数据集的部分。对开发者和企业采购方,这再次说明消费级产品与 API/企业版在数据处理上存在差异:涉及客户数据、医疗、金融等敏感场景时,应优先选择默认关闭数据收集的企业方案,并在合同层面确认人工审阅和留存条款。对内容创作者,若日常工作流大量依赖 ChatGPT 处理未公开素材或商业机密,同样需要按敏感数据标准做隔离。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 OpenAI 是否会进一步明确“人工审阅”的告知措辞和退出机制,而不只是补充退出数据收集;二是匿名化过滤漏掉个人数据的比例是否有第三方审计;三是谷歌、Anthropic、Perplexity 等竞品是否跟进调整隐私文档,把人工审核写得更清楚。目前公开信息显示,莉莉计划的规模、审核员人数和数据处理链路细节仍未披露。
来源:IT之家(RSS)


