一句话看懂:Anthropic 展示了 Claude 在数学研究上的一次完整闭环:独立产出论文、内部专家验证、外部专家评审,并生成形式化可验证证明。Hacker News 讨论的焦点却不是“AI 多聪明”,而是这种成果高度依赖人类“鼓励”这类难以标准化的互动,以及结果能否被复现。
事件核心:发生了什么
据 Anthropic 官方说明,Claude 这次完成的数学论文,经过了内部两位数学家研究验证,并由外部专家 Brian Conrey 和 Dan Goldston 在短时间内审阅;Claude 还为最终结论生成了 Lean 形式化可验证证明。文章讨论中,一位 Hacker News 用户分享了自己过去一年里用 Claude 处理布尔电路、FHE 和 Lean 证明的经历——他曾让 Claude 在一周内反复收敛一个 K=7 的 SAT 问题,最终确认 K=7 为 SAT、所有 K<7 与 K>7 均为 UNS



