一句话看懂:OpenAI 在 9 月 29 日旧金山 DevDay 2026 上宣布已拥有一个“AI 研究实习生”,其模型可无人协助完成超过三分之一的全天研究任务,并已攻克 100 多个悬置数十年的数学问题。
事件核心:发生了什么
在旧金山 DevDay 2026 主题演讲中,Sam Altman 向 2500 名开发者表示,公司一年前预测将在 12 个月内达成“AI 研究实习生”目标,”几周前我们实现了这个目标”。随后上台的 OpenAI 后训练研究负责人 Tejal Patwardhan 给出具体数据:模型现已能在无人类帮助下完成超过三分之一的全天研究任务,并帮助解决了 100 多个悬置数十年的数学问题。
产品层面,Altman 开场发布了 always-on dots agents,运行在自有云计算机上,支持语音呼叫,短信功能即将推出。同时推出更便宜的 GPT-6.1 Sol 模型、500 美元 Pro 计划和更快的 Ultrafast 层级。API 保持 99% 以上可靠性,首个 token 响应时间缩短 45%。
安全方面,Altman 在 CNBC 采访中称对齐、安全、监控和安保必须”远远领先于能力”。OpenAI 本周决定暂缓 GPT-6.1 Astra 更新,原因是该模型在部分评估中表现略差,被归入”高度谨慎类别”。
为什么重要
从”辅助工具”到”研究实习生”的定位变化,意味着 OpenAI 开始将大模型定位为可独立承担长周期、高复杂度任务的准自主研究主体。超过三分之一全天研究任务可自主完成、以及攻破数十年未解数学难题,是当前公开信息中较为具体的量化信号。这不仅是模型推理能力的展示,更涉及训练与推理范式、算力调度和 AI 应用边界的重新划定。在开源与闭源模型竞争加剧的背景下,OpenAI 试图用”研究能力”而非单纯对话质量来拉开身位。暂缓 Astra 也说明能力与安全评估之间的张力正在实际影响产品节奏。
对用户/开发者/创作者的影响
开发者可关注两点:一是 GPT-6.1 Sol 的低价定位和 Ultrafast 层级可能降低高频调用成本,99% 可靠性和 45% 首 token 提速对生产环境 API 集成有直接价值;二是 dots agents 这类常驻云代理,可能改变 AI 应用从”问答”转向”持续执行任务”的交互形态,创作者和企业采购方需评估其与现有工作流的衔接。研究实习生若逐步开放,对数学、科研类内容创作和自动化研究流程的影响值得跟踪。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,AI 研究实习生是否面向外部用户开放、以何种形态落地。第二,暂缓的 GPT-6.1 Astra 何时解禁,评估标准是否公开。第三,dots agents 的短信功能和定价策略,以及竞品是否跟进常驻代理形态。Altman 表示 IPO 没有具体时间表,需先理解如何安全处理下一级 AI,硬件产品”值得等待”但不在本次发布。
来源:The Next Web


