一句话看懂:OpenAI 在 GitHub 发布了 722 篇手稿,涉及 372 个数学问题的解答或进展,成果来自一个未公开的 ChatGPT 前沿模型。这再次点燃了数学界对 AI 证明可靠性的争议。
事件核心:发生了什么
2026 年 10 月 7 日,OpenAI 宣布在 GitHub 上公开了 722 篇手稿,覆盖 372 个主要数学问题的解答或部分进展。这些结果由一个尚未发布的 ChatGPT 前沿模型生成,并得到了 OpenAI 新成立的人工智能数学咨询小组(AGMAI)的确认。OpenAI 表示,这些成果是此前“模型已解决超过 100 个长期未解问题”声明的延续。据其披露,平均每个结果需要约三小时的 ChatGPT Pro 使用时间。部分重点成果包括:四维 Kakeya 猜想的解答、对关键计算机算法的改进,以及在黎曼猜想上的进展。OpenAI 向《科学美国人》透露,几乎每篇论文都来自向单个 AI 智能体输入的一次性提示。
为什么重要
这是 OpenAI 首次以大规模、系统化的方式发布 AI 生成的数学成果,且声称多数问题仅需单次提示即可推进。如果这些结果被数学界证实,将意味着大模型在严格推理和发现新数学知识方面取得了实质性突破,可能改变数学研究的协作方式。然而,此前的 Navier-Stokes AI 争议已让数学界对类似声明保持警惕。OpenAI 虽然遵循了 AGMAI 的部分建议,比如通过传统学术渠道发布、提供模型名称和提示信息,但也忽略了关于公布具体算力消耗和所用提示的要求。目前公开信息显示,这些论文尚未经过同行评审,其真实价值仍需数学家独立评估。
对用户/开发者/创作者的影响
对开发者和研究者而言,GitHub 仓库提供了模型推理过程和算力估算的参考,但缺少精确推理时间和提示细节,难以直接复现。目前这些成果仅代表模型在特定提示下的单次输出,不等于可用的产品功能或已验证的数学定理。对于普通用户和内容创作者,这意味着大模型在专业领域的应用潜力仍在探索阶段,短期内不会直接影响日常工具的使用。企业若考虑将此类能力集成到研发流程,需等待可复现的评测结论和更透明的发布标准。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,数学界能否复现这些结果,尤其是四维 Kakeya 猜想和黎曼猜想相关进展。第二,OpenAI 是否会应社区要求补全算力消耗和提示细节,并发布模型供独立测试。第三,AGMAI 的审查机制能否成为行业标准,影响未来 AI 生成科研内容的发布规范。
来源:Engadget


