OpenAI 发布内部研究加速报告:已达成自动化研究实习生目标,推进 2028 年 3 月自动化 AI 研究员

OpenAI 宣布已在今年 9 月达成“自动化研究实习生”目标,即在人类指导下可完成需熟练研究员数日工作的系统,同时正推进在 2028 年 3 月实现自动化 AI 研究员。值得关注的是,内部数据显示 AI 智能体已实质性加速其研究进度,但 OpenAI 同时强调会保留人类控制权并可能因安全风险暂停开发。

OpenAI 宣布已在今年 9 月达成“自动化研究实习生”目标,即在人类指导下可完成需熟练研究员数日工作的系统,同时正推进在 2028 年 3 月实现自动化 AI 研究员。值得关注的是,内部数据显示 AI 智能体已实质性加速其研究进度,但 OpenAI 同时强调会保留人类控制权并可能因安全风险暂停开发。

OpenAI 首席科学家 Jakub Pachocki 发文承认,随着推理模型能力快速提升,公司对模型内部“思维链”(CoT)的监控与解释能力正在减弱,并警告 AI 可能走向递归式自我改进(RSI),呼吁采取更广泛的干预措施,而不仅是技术层面的对齐研究。

摩根士丹利最新研报指出,数据中心与AI算力扩张已成为2026年美国中期选举的关键议题,多场国会选举结果可能直接影响大型AI基建项目的选址与落地进度。

越来越多企业开始为“内部书面沟通中的 AI 使用”立规矩,明文禁止员工把未经消化的 AI 长文直接丢给同事。这标志着 AI 写作的管控重点从“是否用”转向“如何负责任地用”。

部分求职者开始在简历中嵌入针对 AI 招聘系统的提示词注入指令,试图操纵或绕过算法筛选。这件事暴露了 AI 招聘工具在数据安全和公平性上的薄弱环节,也促使企业和开发者重新审视自动化筛选机制的可信度。

Anthropic 旗下的 Claude 现在可以直接接管 Gmail 收件箱,在获得授权后自动撰写、回复和转发邮件,无需用户逐封批准。Engadget 的报道指出,这项能力在便利之余引入了提示注入攻击、AI 幻觉和隐私等多重风险,目前尚无彻底解决方案。

《纽约时报》报道称,生成式 AI 的普及几乎摧毁了肯尼亚内罗毕的论文代写产业——这个曾雇佣逾 4 万人的灰色行业,如今正面临大规模失业,且转型路径极为有限。

OpenAI 发布 GPT-6 Astra 时宣称其在 ARC-AGI-3 测试中达成 99.9% 的“AGI 级”得分,但该测试的出品方 ARC Prize 用标准评测工具复测后得分仅为 62.7%。差距源于测试用“脚手架(harness)”不同,而非模型本身能力突变。

美国警用安防公司 Flock 的 AI 搜索工具界面被《连线》记者逆向工程并公开,外界第一次能直观看到这一部署超 12 万摄像头的系统如何执行车辆与人员检索——包括持续监控某区域直到匹配特定描述人物的功能。

OpenAI 正式弃用了其官方的 skills 示例仓库,将 Codex 的技能生态统一迁移至 Plugins 仓库和《构建插件》指南,意味着 Agent Skills 的开发入口和分发方式正在收口到插件体系中。