404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型

404 Media 披露 OpenAI 内部代号“莉莉计划”的人工评估流程:审核员会阅读经匿名化处理的真实 ChatGPT 对话,评判模型回复质量。值得关注的是,匿名化并不总能过滤掉个人信息,而不少用户把 ChatGPT 当作倾诉对象。

404 Media 披露 OpenAI 内部代号“莉莉计划”的人工评估流程:审核员会阅读经匿名化处理的真实 ChatGPT 对话,评判模型回复质量。值得关注的是,匿名化并不总能过滤掉个人信息,而不少用户把 ChatGPT 当作倾诉对象。

Product Hunt 上出现了一款把 AI Assistant 市场做成交互式地图的产品,试图用可视化方式梳理这个快速膨胀、却日益碎片化的赛道。它值得关注,是因为当下选 AI 助手最大的痛点不是没得选,而是不知道有哪些、彼此差在哪。

因数据保留条款争议,英伟达、Palantir、Booz Allen 等企业限制或停用 Claude 高能力模型;同时黄仁勋在公开场合明确反对放缓前沿 AI 发展,并获特朗普电话支持,行业"减速"与"加速"路线分歧进一步公开化。

本周 AI 圈同时出现三条值得留意的信号:月之暗面对谣言报警、Anthropic 公开大模型被用于规模化诈骗的真实案例、OpenAI 明确暂缓上市并表示将与其他公司讨论放缓 AI 发展;此外 DeepSeek 的扩招全部投向工程落地,没有一个 AI 研究岗。

OpenAI 先用 Python 快速搭起核心存储平台 Habitat,明知未来要重写仍主动“欠债”;一年后,仅 2 名工程师借助 Codex 和 GPT-5.5 将服务重写为 Rust,目前 Rust 版本已承担 95% 生产请求。这为“大模型如何改变技术债偿还成本”提供了一个具体样本。

OpenAI 把伦敦法律科技初创公司 Telon 列为“select partner”,后者不卖软件,而是派“法律工程师”进驻律所和企业法务团队,教律师真正用起 AI 工具。这透露出 OpenAI 进入垂直行业的打法:不只卖模型,也卖落地服务。

围绕“AI 末日论”的争论从硅谷扩散到中国互联网,微博上“中国 AI、美国 AI”成为热门话题。讨论焦点不在技术本身,而在美国放缓呼吁是真心防风险,还是想拖住中国追赶。

纽约大学数学教授 Tristan Buckmaster 指控 OpenAI 在他与 Anthropic 研究员 Levent Alpöge 已取得进展的方向上“抢发”纳维-斯托克斯方程成果,并称 OpenAI 科学家曾施压他联合署名。事件背后是 AI 大算力正在改变数学研究的发表规则。

前 OpenAI、Anthropic 预训练研究员 Jacob Coxon 9 月 8 日公开辞职,批评两家公司正“直奔自我改进的超级智能”,帖子 36 小时内获 1.53 亿次浏览,并迅速引发 Anthropic CEO Dario Amodei 及 OpenAI、SpaceXAI 高层的公开回应。

Anthropic 推出 Claude for Financial Advisors,在 Claude 之上叠加连接器和预置工作流,把电子表格、投资组合系统、CRM 等工具串成一个入口。它瞄准的是财务顾问被行政和准备工作占掉的时间。