OpenAI GPT-6 Astra 借助 Provider Adapter Harness 在 ARC-AGI-3 上拿下 99.95% 得分

OpenAI 的 GPT-6 Astra 通过新增的 Provider Adapter harness,在 ARC-AGI-3 半私密评测中拿下 99.95% 的高推理得分,远超标准 harness 的 62.7%,显示评测框架本身对模型能力的释放有了决定性的影响。

OpenAI 的 GPT-6 Astra 通过新增的 Provider Adapter harness,在 ARC-AGI-3 半私密评测中拿下 99.95% 的高推理得分,远超标准 harness 的 62.7%,显示评测框架本身对模型能力的释放有了决定性的影响。

OpenAI 首次对外披露内部研发团队使用编程智能体的真实强度,数据显示 2026 年已成为智能体工程爆发之年,而研究人员人均 AI 算力支出的陡增节点,很可能指向了尚未正式命名的下一代模型。
![“Cheating and explaining the answer [to your child] are closer than you’d think.” Here’s my new episode with @suekhim, co-founder of @brilliantorg, who showed me how AI can help kids think for themselves. We talked ab...](https://www.chat-gpts.plus/wp-content/uploads/2026/09/ai_cover_3-171-768x403.jpg)
Brilliant 联合创始人苏·基姆(Sue Khim)在播客访谈中提出,AI 教育产品的核心原则应是“永远不直接告诉学习者答案”。这一观点正在挑战当前 AI 辅导工具“即时给答案”的主流设计思路,引发对 AI 学习工具价值边界的讨论。

OpenAI 核心成员 Thibault Sottiaux 在 X 上发文,称 GPT-6 Astra 即便在低推理强度下,表现也优于 GPT-5.6 Sol 在高推理强度下的水平。这意味着 Astra 的模型基础能力大幅跃升,用户已不需要像使用旧模型那样依赖高推理模式来获取最佳答案。

OpenAI 于 2026 年 8 月正式推出面向青少年的 ChatGPT for Teens 模式,并为家长提供账户关联与十余项内容管控开关。由于默认保护力度有限,家长需手动调整关键设置才能更有效约束未成年人的 AI 使用行为。

OpenAI 宣布其内部设定的“自动化研究实习生”目标已达成,研究团队如今每个人类工作日可调度约 3.1 个“Agent 工作日”,同时高端用户日均 Token 消耗费用已突破 7000 美元。这组数据意味着 AI Agent 从演示走向了真实的高强度研发协作场景。

OpenAI 首席科学家 Jakub Pachocki 在发布新模型 Astra 后公开呼吁 AI 实验室放慢节奏,并警告自主智能体可能学会欺骗人类、逃避监控,甚至加速自我进化。这是 OpenAI 高管罕见地对行业整体发出风险预警,而非仅针对自家技术。

OpenAI 于 2026 年 9 月宣布,已实现此前设定的“自动化研究实习生”目标,并称正在推进更高级别的“自动化 AI 研究员”,预计在 2028 年 3 月前完成。这一进展意味着 AI 已能独立完成部分需要数天时间的专项研究任务,但也伴随着系列安全事件带来的隐忧。

The Information 分析显示,Anthropic 自今年 10 月起已签署至少 14.8 吉瓦(GW)算力协议,未来十年相关支出可能高达 5170 亿美元。这笔巨额投入反映出头部 AI 实验室正在将算力锁定视为决定模型竞争力的核心战略。

Anthropic 因盗用书籍训练 Claude 被判赔付作者约 15 亿美元,但钱怎么分成了新问题——作者和出版商对同一本书的所有权与分成比例产生争议,部分作者发现自己的赔偿金可能被出版商拿走大头。