Claude 完成 Fermat 大定理的形式化证明,生成超 1300 万行 Lean 代码

Anthropic 旗下模型 Claude 完成费马大定理的首次完整形式化证明,生成超过 1300 万行 Lean 代码。这个原本专家预计需要多年才能推进的项目,在一个月内完成,也是目前最大的 Lean 形式化证明。

一句话看懂:Anthropic 旗下模型 Claude 完成费马大定理的首次完整形式化证明,生成超过 1300 万行 Lean 代码。这个原本专家预计需要多年才能推进的项目,在一个月内完成,也是目前最大的 Lean 形式化证明。

事件核心:发生了什么

Anthropic 于 9 月 4 日通过官方 X 账号披露,Claude 完成了费马大定理的正式化证明。费马大定理由英国数学家 Sir Andrew Wiles 在 1995 年首次证明,距该猜想提出已超过 350 年。此次由 Claude 生成的证明总体量超过 1300 万行代码,不仅通过 Lean 证明助手完成机器验证,还顺带证明了该证明所依赖的超过 2.9 万个其他定理,覆盖了大量此前从未被正式化的数学分支。完整证明过程已发布在 Anthropic 的 Science Blog,全部代码也已开源至 GitHub 仓库 anthropics/fer…。该帖发布后获得约 270 万次浏览。

为什么重要

这一进展的行业意义在于它把 AI 在数学验证领域的应用从“辅助解题”推进到“独立完成大型证明工程”。Lean 和 Mathlib 是数学形式化领域的核心基础设施,此前形式化大型经典定理通常需要专家团队投入数年时间。Claude 在一个月内完成这项工作,一方面验证了前沿大模型在长链条逻辑推理与代码生成上的能力上限被显著拉高;另一方面也意味着 AI 可以分担数学审稿中最耗时、最依赖人工的部分。Anthropic 明确将此定位为“加固数学知识核心”的长期工作一环,背后有数百年数学积累和数百位 Lean/Mathlib 贡献者的基础。对同行而言,这是一个可复现、可验证的基准,直接指向大模型在科学严谨性任务上的可用性,而非停留在对话或内容生成层面。

对用户/开发者/创作者的影响

对数学研究者与形式化验证工程师而言,开源的 1300 万行 Lean 代码提供了目前规模最大的可用语料库,可用于训练数学推理模型、改进证明搜索算法或复用其中的定理库。对使用 API 的开发者来说,这一案例展示了大模型处理高复杂度、长上下文任务的潜力,可作为评估推理能力边界的重要参考。对普通用户而言,目前公开信息显示尚无面向大众的产品化落地路径,其直接价值更多体现在科学共同体内部,而非转化为消费级 AI 应用。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

后续值得观察三点:其一,Anthropic 是否会将该能力沉淀为面向学术或企业客户的专项服务,例如付费形式的定理证明辅助 API;其二,该 1300 万行 Lean 证明是否会被 Lean 官方或 Mathlib 社区吸收,从而推动更多经典数学定理进入“机器可验证”状态;其三,竞品模型(如 OpenAI、Google DeepMind 的大模型)是否会公开在同类数学基准上的对应表现,以便横向比较。考虑到该成果发布时间为 2026 年 9 月初,后续是否会有独立第三方复现或扩展同样值得跟踪。

来源:X:Anthropic (@AnthropicAI)

celebrityanime
celebrityanime
文章: 22032

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注