OpenAI在发布由内部前沿模型生成的722篇数学论文不到一天后,因发现关键符号错误撤回其中3篇,并修订了另外14篇。事件引发数学界对批量AI研究成果验证方式的广泛讨论。
OpenAI 在 10 月 6 日公开了 722 篇由内部前沿模型生成的数学论文手稿,但不到一天后便撤回了其中 3 篇。原因是公司在审查中发现了一处符号错误,该错误导致一篇论文中的论证失效,进而影响了依赖该结构的另外两篇论文。此外,OpenAI 还修订了另外 14 篇手稿。
这批涵盖代数、几何和计算机科学等领域的论文被归入 372 个成果族,最初托管于一个公开的 GitHub 代码库。此次撤稿进一步引发了数学界对如何验证批量发布的 AI 研究成果的激烈讨论。

根据代码库 10 月 7 日的修订记录,问题出自论文《可裂阿贝尔八维簇上 Weil 类的代数性》(Algebraicity of Weil classes on split abelian eightfolds)。记录显示,“一处符号错误导致稳定化迹消去论证失效,并破坏了后续两篇论文所采用的构造”。
受此波及的两篇论文分别是《K3 曲面 Kuga–Satake 对应的代数性》(Algebraicity of Kuga–Satake Correspondences for K3 Surfaces)和《K3 曲面乘积的有理霍奇猜想》(The rational Hodge conjecture for products of K3 surfaces)。目前被撤回的论文仍保留在库中,附有说明漏洞的标注。目录现包含 719 篇论文。
针对另外 14 篇修订手稿,OpenAI 修复了证明过程、修正了表述、明确了假设与依赖关系,并更新了一处过时的文献引用。13 篇关联论文的引用也同步更新。
OpenAI 发言人向 Retraction Watch 表示,这些错误是公司在内部审查中发现的,“我们欢迎数学界的审查与反馈,如果找不到修复方法,我们将撤回论文”。发言人向《大西洋月刊》透露,预计这类错误会“非常罕见”。OpenAI 研究主管 Dan Roberts 也在社交平台上宣布了撤稿消息。
这批研究成果中,仅有约 42% 附带了 Lean 形式化证明——一种用于计算机形式验证的编程语言。其余论文仅以常规文本形式存在。OpenAI 称,其合作的“数学与人工智能顾问小组”建议在未完全实现形式化之前就发布成果。
康奈尔大学数学家 Alex Townsend 认为未来可能还会发现更多错误。他表示:“考虑到数学界对 AI 的怀疑态度,我认为 OpenAI 应该优先公布那些经过 Lean 验证的手稿。”多位数学家也指出,部分论文似乎并未真正证明其声称的结论。
韩国科学技术院(KAIST)AI 数学研究生院院长 Baek Hyeongryeol 评价称,如果某些结果被证实无误,甚至“配得上菲尔兹奖”,但他同时表示手稿内容“极难读懂”。
Baek 指出:“证明是否正确固然重要,但它融入人类知识体系的过程同样重要。”
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断