OpenAI 官宣“下一代重大模型”Astra,一口气解出十道此前未解的数学题。

OpenAI 通过发布一篇数学报告,首次正式确认下一代模型家族名为“Astra”,并宣称其内部版本解出了十个十年未破的数学难题。这不仅是一次技术展示,也意味着 AI 在长时间、多代理协作任务上迈出了具体一步。

一句话看懂:OpenAI 通过发布一篇数学报告,首次正式确认下一代模型家族名为“Astra”,并宣称其内部版本解出了十个十年未破的数学难题。这不仅是一次技术展示,也意味着 AI 在长时间、多代理协作任务上迈出了具体一步。

事件核心:发生了什么

8月1日,OpenAI 发布数学报告,首次公开确认 Astra 是“下一代主要模型家族”。据报告,Astra 的内部版本解决了十个此前悬而未决的数学及理论计算机科学开放问题,覆盖高维几何、编码理论、群论、量子复杂性、格密码和极值组合学等多个领域。其中一项证明建立了非 sofic 群的存在性,解决了群论中的一个长期开放问题。

OpenAI 表示,生成这十个解所需 token 按 Sol 的 API 费率计算约为 2000 美元。模型产出推理过程后,人类研究人员再配合模型把结果整理成论文,并用 Lean 形式化验证了每个证明。此前 The Information 报道,Astra 被定位为一套面向长时运行任务的模型家族,通过协调多个代理共同处理复杂问题,Sam Altman 已在华盛顿向监管者做过演示。

为什么重要

这次发布的意义在于,OpenAI 把“数学难题”作为可核查的产出标准来展示推理能力,而不是只依赖内部测试集。曼彻斯特大学数学家 Thomas Bloom 评价称,这些结果比此前单位距离猜想的反例更重要,但他也反对“AI 取代数学家”的说法,认为模型基于超过一个世纪的数学理论构建。另一个关键背景是,Astra 将成为美国新监管框架下首个需官方批准才能发布的模型,这让它在产品之外也带有政策样本属性。

值得注意的是,OpenAI 研究员 Noam Brown 在 X 上表示,Astra 并未解决任何千禧年难题,同时强调“每个问题的算力投入不高,测试时计算还有很大提升空间”。这说明当前能力仍有明确边界,但技术路线已经清晰指向更深的推理计算。

对用户/开发者/创作者的影响

对普通用户来说,Astra 的目标不是速答式聊天,而是需要连续运行数小时甚至数天的复杂任务。未来产品形态可能更接近“代理式工作流”,用户只需要设定目标,模型自行调度多个子代理推进。对开发者和企业而言,需要注意 AI 应用的算力成本结构变化——十个数学问题约 2000 美元、每个问题平均 200 美元,意味着深度推理能力不会以低价形式出现在 API 中。创作者和研究者可以关注的是,OpenAI 这次强调“机器可验证证明”,这种“推理 + 形式化验证”的组合可能成为处理高风险、高精度任务的新范式。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一个观察点是产品命名与上线节奏:Astra 最终是作为 GPT-6 还是 GPT-5.x 变体推出,尚未确定,发布时间也未公布。第二个观察点是监管流程:美国官方审批将以何种标准评估 Astra,会不会要求披露训练数据、评测方法或安全测试结果,将直接影响后续大模型发布机制。第三个观察点是学术界的反应:数学界是否认可“AI 作为论文作者”的归因方式,以及竞品是否会跟进这种“用可验证数学题做能力证明”的发布策略。

来源:<a href="https://the-decoder.com/openai-announces-its-next-major-model-astra-by-dropping-ten-previously-unsolved

celebrityanime
celebrityanime
文章: 16383

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注