OpenAI发布的纳维-斯托克斯方程包含一份基于Lean 4的正式证明

据科技博客 John D. Cook 报道,OpenAI 发布的一份围绕纳维-斯托克斯方程的成果中包含基于 Lean 4 的形式化证明,这意味着大模型开始被用来辅助生成可被机器逐步校验的数学证明,而不只是给出自然语言推理。其真正价值在于:AI 的输出第一次能落到一个"可验证"的工程流程里。

据科技博客 John D. Cook 报道,OpenAI 发布的一份围绕纳维-斯托克斯方程的成果中包含基于 Lean 4 的形式化证明,这意味着大模型开始被用来辅助生成可被机器逐步校验的数学证明,而不只是给出自然语言推理。其真正价值在于:AI 的输出第一次能落到一个"可验证"的工程流程里。

Anthropic 研究员 Jacob Coxon 本周公开辞职,称头部 AI 公司正像“失控列车”一样推进模型,并声称“造 AI 的人真心相信它可能在本十年内灭掉人类”;Anthropic 一位安全高管随后基本认同这一判断,把 AI 末日论再次推上舆论中心。

OpenAI 因新模型 Astra 需求过大,暂时关闭每月 200 美元的 Pro 订阅入口,以缓解算力压力。这是少见的“有钱也先别买”的供给端动作,说明顶级推理模型的算力瓶颈正在直接影响商业化节奏。

OpenAI 把支撑 Codex 的 Agent 工具链(业内常称为 Codex harness)封装成 Agents API 并进入公开测试,开发者一次 API 调用就能调用完整的代理执行能力,而不必自己搭建工具调度、执行循环和状态管理。

英伟达 CEO 黄仁勋在高盛科技会议上重申,公司下一财年营收有望同比增长约 70%,按分析师预期本财年约 4000 亿美元计算,明年营收可能逼近 6800 亿美元。这一判断的关键不是 GPU 卖得好,而是英伟达认为自己已经嵌入 AI 产业链的每一环。

Cursor 正式推出 Projects 功能,用一个“协调者智能体”调度数千个子智能体,处理功能开发、代码迁移这类跨月的大型工程任务。这是在把 AI 编程从“对话式结对”推向“指挥式外包”。

Anthropic 发布报告,指控阿里巴巴、月之暗面(Moonshot AI)和 DeepSeek 等中国 AI 公司对 Claude 发起大规模“蒸馏攻击”,试图套取模型推理过程来训练自家模型。这是目前公开披露的规模最大的一类模型能力窃取指控,涉及近 2 亿次交互。

OpenAI 于 2026 年 9 月 10 日推出 Agents API 公测版,把驱动 Codex 的智能体运行框架和托管基础设施开放给开发者,一次 API 调用即可创建可长时间运行的云端 agent。

OpenAI 推出面向金融行业的 ChatGPT for Financial Services,能研究公司、分析财务数据并生成投行风格 PPT,直接对标华尔街初级分析师和助理的日常工作。

Meta 推出首款 AI 助手 Muse,能跨 Gmail、亚马逊等第三方账号自动执行清理邮件、下单购物等任务,但实测者发现它基于 Instagram 和 Facebook 数据推断出的个人兴趣极为精准,引发对隐私边界的担忧。