Anthropic 称 Claude 在 11 天里“基本自主”地用 Lean 编程语言将费马大定理的证明形式化。(Anthropic)

Anthropic 于 2026 年 9 月 4 日披露,其 Claude 模型在 11 天内“基本自主”地使用 Lean 编程语言将费马大定理的证明形式化。这件事之所以值得关注,是因为它展示了大模型在长周期、高难度数学推理任务上的持续作业能力,而非简单的问答式生成。

一句话看懂:Anthropic 于 2026 年 9 月 4 日披露,其 Claude 模型在 11 天内“基本自主”地使用 Lean 编程语言将费马大定理的证明形式化。这件事之所以值得关注,是因为它展示了大模型在长周期、高难度数学推理任务上的持续作业能力,而非简单的问答式生成。

事件核心:发生了什么

据 Techmeme 归档页面在 2026 年 9 月 4 日收录的信息,Anthropic 对外宣称其 Claude 模型在“基本自主”的状态下,花费 11 天时间,使用 Lean 编程语言完成了费马大定理证明的形式化工作。这并非 AI 独立证明该数学定理,而是将既有的人工证明步骤转译并验算为机器可校验的 Lean 代码,确保推理链条在逻辑上无懈可击。相关细节目前由 Anthropic 官方披露,暂未见完整的技术报告或第三方复现结果,具体的算力消耗与模型调用方式也尚未公布。

为什么重要

这项工作更重要的是展示了大模型在“自动驾驶”模式下的稳定性和推理深度。与常见的多步问答或代码补全任务不同,形式化证明要求在数天甚至数周内保持上下文一致性,处理成千上万个逻辑依赖节点,并随时修正 Lean 编译器反馈的错误。如果 Anthropic 的说法属实,这标志着闭源大模型的应用场景正从单轮交互、短任务自动化,扩展至可独立运行数日的长周期科研计算流水线。同时,它也为大模型在数学定理机器化验证、程序正确性证明以及金融合约或安全协议审计等对逻辑完整性要求极高的领域,提供了一个技术可行性的参考案例。

对用户/开发者/创作者的影响

对于学术研究者与数学爱好者而言,这类能力若能通过 API 开放,将大幅降低使用 Lean、Coq 等证明助手的学习门槛——用户只需用自然语言描述欲证明的命题,模型便能尝试搭建可验证的证明脚本。对于软件开发者,尤其是在区块链、操作系统或核心算法库中从事安全关键代码编写的人群,将“业务代码”自动转化为机器可验证的规范,可能成为未来 CI/CD 流程中的一个审计环节。对于普通用户而言,短期内这一能力与日常消费级 AI 应用距离尚远,但它会加速计算数学与自动推理工具的普及,最终可能影响教育软件中的数学辅导、习题验证产品形态。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

目前公开信息显示,Anthropic 尚未开放该功能,也没有透露具体使用了 Claude 的哪一个版本。后续建议留意三个方面:一是 Anthropic 是否会发布配套的技术报告,公开任务中的 token 消耗、人工介入频次及失败重试机制,这将决定“自主性”的含金量;二是这一能力是否被沉淀为 Claude 的正式功能或 API 接口,并配备按任务计费的模式,而非事件性的演示成果;三是 OpenAI、Google DeepMind 等竞争对手是否会迅速在 Lean 数据集或自动定理证明基准上跟进,届时才能判断此次 11 天的形式化任务是孤例还是一条新赛道的开端。

来源:Techmeme

celebrityanime
celebrityanime
文章: 22037

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注