OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

据 404Media 报道,OpenAI 内部存在一个名为 "Project Lily" 的项目,由人类审核员查看 ChatGPT 用户的真实聊天记录,用于评估模型回答质量。这暴露出一个被多数用户忽略的事实:你与 AI 的私密对话,可能正被人阅读。

据 404Media 报道,OpenAI 内部存在一个名为 "Project Lily" 的项目,由人类审核员查看 ChatGPT 用户的真实聊天记录,用于评估模型回答质量。这暴露出一个被多数用户忽略的事实:你与 AI 的私密对话,可能正被人阅读。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款原生语音模型,首次在低延迟语音流中实现多步深度推理,让 AI 可以"边说边想",而不是在遇到难题时沉默等待。

vivo 在 2026 年开发者大会上宣布蓝心大模型全面升级,一次性发布四款模型,分别承担语音理解、端侧感知记忆和云端任务执行,试图把手机从"能聊天"推进到"能办事"。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,核心变化是让 AI 在连续语音对话中同步完成推理和后台任务调用,语音助手不再只是“能听会说”。

斯坦福 NLP 组推出新课程 CME 295,由制作过 CS 229/230 知名速查表的 Amidi 双胞胎兄弟主讲,用 9 讲压缩讲完从 Transformer 架构到 AI Agent、扩散语言模型的 LLM 全栈知识地图,课程资料与速查表全部公开。

研究者 Phoenix Yin 在 X 上发布长文,用流形假说、互信息、Kolmogorov 复杂度和信息瓶颈串起一条论证:智能成立的前提是现实世界存在可压缩的稳定结构,因此学习在本质上接近压缩,而大模型的记忆、泛化、类比和推理只是同一机制在不同尺度上的表现。这是一篇观点性长文,不是产品发布。

前 OpenAI 研究员、InstructGPT 论文作者 Diogo Almeida 发布新模型 Jev,它跳过自然语言生成,直接输出结构化决策和概率,官方称在判断类任务上快 20-200 倍、成本低 40-400 倍。这代表一条有别于「更大更聪明」的实用主义路线,目标是把智能做成软件里廉价、高频的调用。

Datawhale 社区推出开源教程项目 Hello-Agents,主张“穿透框架表象”,带开发者从手搓 ReAct 一路走到用 GRPO 做 Agentic-RL 训练,覆盖原理、框架、协议与真实案例。它的差异点是:不只教“怎么搭”,还系统讲“搭错了怎么调”。

《纽约时报》与锡耶纳大学最新民调显示,61% 的潜在选民反对为 AI 建设数据中心,但 AI 与数据中心在中期选举议题优先度中仍排在最末,反对声浪尚未转化为投票动力。

马斯克在 All-In 峰会上提议,头部 AI 公司应在模型发布前互相交叉测试,用竞争对手的工具来挑自家模型的毛病。这背后是业界对前沿模型失控风险的真实焦虑。