一句话看懂:据 404 Media 调查,OpenAI 雇用了数百名外包人员阅读真实 ChatGPT 对话,为模型输出打分并抑制“过度讨好”和“拟人化”倾向。这些对话虽经匿名化处理,但仍可能包含用户主动写下的隐私信息。
事件核心:发生了什么
404 Media 获取了 OpenAI 内部泄露文件并采访了相关人员。这些外包审核员按 1 到 7 分为 ChatGPT 的回答打分,任务包括降低模型“过度恭维”和“过度像人”的表现。一名审核员表示,他不认为用户知道是真人正在读他们的聊天记录。被审阅的提示词中,确实有用户明确要求 ChatGPT 对内容保密,但这些对话仍进入了审核流程。素材显示,提示词经过匿名化处理,但仍可能含有敏感个人信息;OpenAI 设有隐私过滤器,但承认它可能出错。
审核员通过 Crossing Hurdles 招募,薪酬由 AI 训练公司 Mercor 发放。一名北美审核员称时薪超过 50 美元。用户若想阻止自己的对话被用于训练、进而可能被人工查看,需要关闭默认开启的“为所有人改进模型”设置,且该设置只对新对话生效;临时聊天模式则声称不将输入用于训练。
为什么重要
这起事件暴露的是大模型训练链条中长期存在、却很少被清晰披露的一环:人工反馈。对于闭源模型厂商来说,人类审核是评估和调优模型行为的关键手段,OpenAI、Anthropic、Google 都被曝出或承认存在类似做法。Anthropic 向 404 Media 确认会用人工审核 Claude 的回答,但会在审核前剥离邮箱等账户信息;Gemini 也提示用户人类可能查看已保存的聊天。问题不在于“是否该有人工审核”,而在于知情同意的边界:“为所有人改进模型”这样的措辞,读起来更像社区贡献,而不像同意让真人阅读自己的对话。如果 OpenAI 改为明确征求同意,退出率可能显著上升,这也让当前模糊表述显得更像是刻意设计。
对用户/开发者/创作者的影响
对普通用户而言,最直接的动作是检查隐私设置:如果不想让新对话进入训练或人工审核流程,应关闭“为所有人改进模型”,或使用临时聊天模式。考虑到这些选项默认开启且不追溯旧对话,习惯把 ChatGPT 当私人助理的用户需要重新评估输入内容的敏感度。对开发者和企业采购方来说,这意味着在集成 OpenAI API 或面向客户部署 AI 应用时,隐私披露的充分性应纳入合规审查,尤其是涉及医疗、法律、金融等场景。对创作者而言,未公开的创意草稿、脚本或客户资料若输入 ChatGPT,同样可能进入人工审核视野,敏感内容应避免直接粘贴。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 OpenAI 是否会调整设置措辞或改为明确同意,以回应外界对“知情同意”的质疑。二是各地监管机构是否就人工审核对话的披露充分性展开问询,尤其在欧洲等对数据保护要求较严的市场。三是 Anthropic、Google 等竞品是否会在产品中更显眼地提示人工审核范围,把隐私透明度转化为竞争差异点。目前公开信息显示,这类人工反馈仍是模型改进的常见手段,短期内难以被完全替代。


