OpenAI 可能又偷走了一项重大证明

数学家 Andreas Thom 公开指控 OpenAI 可能在训练 Astra 时使用了其未发表的 Gromov soficity 猜想研究对话,而该猜想正是 OpenAI 随后宣布 Astra 已解决的十个问题之一。若属实,这将不是署名纠纷,而是未公开人类成果被模型吸收后反过来被当作 AI 突破来发布的严…

一句话看懂:数学家 Andreas Thom 公开指控 OpenAI 可能在训练 Astra 时使用了其未发表的 Gromov soficity 猜想研究对话,而该猜想正是 OpenAI 随后宣布 Astra 已解决的十个问题之一。若属实,这将不是署名纠纷,而是未公开人类成果被模型吸收后反过来被当作 AI 突破来发布的严重问题。

事件核心:发生了什么

据 Valerio Capraro 在 X 上的转述,Andreas Thom 在一篇详细的 Mastodon 长文中给出多项证据,指向 OpenAI 曾用他与 Gábor Kun 讨论 Gromov soficity 猜想的对话训练 Astra。该猜想属于 OpenAI 后来宣布 Astra 已解决的十个数学问题之一。Thom 是 sofic 与 hyperlinear 群方向的领军学者,研究该问题约二十年,其学术履历与领域地位在数学界有较高共识。Capraro 强调,如果这一说法成立,性质就不是普通的归属争议。

此前 Levent Alpöge、Tristan Buckmaster 已提出过类似质疑。Capraro 认为,若这些指控都被证实,就不再是孤立事件,而可能构成科学史上规模罕见的学术丑闻之一。目前公开信息显示,这些仍属指控与推论,尚未看到 OpenAI 的正式回应或独立调查结论。

为什么重要

这件事触及大模型训练数据合法性与学术伦理的要害。数学证明与未发表手稿不同于公开网页,通常不在可抓取范围内。如果闭源模型通过非公开渠道吸收此类人类工作,再以“模型自主突破”对外呈现,会直接动摇学界对 AI 科研能力的信任基础。对行业而言,这也意味着“AI 解出难题”的叙事需要更严格的可验证流程,包括数据来源审计、推理过程留痕和外部复现,而不仅是发布结果。

对用户/开发者/创作者的影响

对开发者来说,一旦训练数据来源争议扩大,闭源大模型和 API 在金融、科研、法律等敏感场景的采购合规审查可能收紧,企业会要求供应商提供更清晰的数据治理说明。对内容创作者和研究者,未发表手稿、私有对话、内部文档在使用云端 AI 工具时被纳入训练的风险需要重新评估,本地部署或明确 opt-out 的模型会更受青睐。对数学与科研用户,模型给出的证明仍必须做独立验证,不能把“宣布解决”当作结论。开源模型在此类争议中可能获得一定信任优势,但同样需要透明的数据说明。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 OpenAI 是否就 Thom 的具体指控作出正式回应,以及是否公布 Astra 解决该猜想的数据来源和训练记录。二是是否有第三方机构或学术组织介入核查,尤其是 Gromov soficity 猜想相关证明能否被独立复现。三是 Levent Alpöge、Tristan Buckmaster 等人的指控是否进一步合并为系统性调查,以及这会否影响监管对模型训练数据的合规要求。

来源:Hacker News · 24h最热

celebrityanime
celebrityanime
文章: 22717

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注