OpenAI 周二一次性公布了由一款尚未对外开放的内部 AI 模型生成的 722 篇数学稿件,并将其归类为 372 个“结果家族”,接下来如何评判这些成果、以及它们是否符合新近提出的发布规范,将交由全球数学界来决定。
要点概览:
- OpenAI 在 GitHub 上发布了 722 篇论文,分属 372 个结果家族,全部出自一款公众尚无法使用的内部模型。
- 由九位数学家组成的独立顾问团强调,其角色并不等同于为这些结果或其产生流程背书。
- 公司表示,缺乏形式化计算机验证的部分结果,可能存在瑕疵甚至错误。
大规模“AI 数学论文”放出
OpenAI 在一份公开的 GitHub 代码库中上线了这批成果,并附上了后续修订及引用规则。该仓库列出的 722 篇稿件被划分为 372 个家族,每个家族围绕一个主要结果,同时纳入相关的辅助论证、推论结果或备用证明。
OpenAI 称,其向模型输入了约 4,000 道问题,只保留了经内部判断“足够重要”的结果。
按公司披露的测算,每个结果平均消耗约 3 小时的 ChatGPT Pro 计算资源。大量证明都配有 Lean 版本——这是一种可由计算机严格核查数学证明的形式化语言。
对于尚未给出 Lean 等形式化验证的部分结果,OpenAI 明言不排除存在问题的可能。
延伸阅读:朝鲜黑客组织 Lazarus 通过中国洗钱网络转移 10 亿美元赃款,ZachXBT 指控
顾问团“澄清立场”:不做结果背书
这批成果由“数学与人工智能顾问小组”(Advisory Group on Mathematics and Artificial Intelligence)提供咨询意见。该小组由九位无偿任职的数学家组成,挂靠于高等研究院(Institute for Advanced Study)。小组在一份声明中表示,其职责既不包括对这些结果本身作出判断,也不代表对 OpenAI 内部流程“盖章认可”。
顾问团强调,只有更广泛的数学共同体,才能实际评估 OpenAI 在多大程度上遵循了此前给出的建议。
这份发表于 9 月 29 日的建议,要求 AI 实验室在发布数学成果时做到:系统引用已有文献;以传统数学论文的写作体例完成证明;披露提示词、推理摘要及计算成本;并将成果托管在不由任何 AI 公司控制的学术存储库中。
OpenAI 表示,正在探索 GitHub 之外由学界主导的托管方案,并计划出资支持围绕重大 AI 数学结果的研讨会。
哈佛大学数学教授、顾问团成员 Melanie Matchett Wood 在 9 月接受采访时提醒,AI 生成的数学内容“往往包含抄袭”,且通常缺乏愿意对此负全责的人类作者。OpenAI 一位发言人则在另一篇报道中承认,公司内部的数学家目前对其中相当一部分新结果“尚未真正理解”。
围绕 Navier–Stokes 的风波尚未平息
此次大规模放出,发生在 OpenAI 与数学界经历一个多月紧张关系之后。
9 月 8 日,OpenAI 宣称其模型“解决了”千禧难题之一——Navier–Stokes 方程问题,并在公开沟通中与纽约大学数学家 Tristan Buckmaster 爆发署名与贡献归属的争议。
三天之后,25 位菲尔兹奖得主联名签署声明,反对将著名未解难题作为 AI 模型的常规测试基准。9 月 21 日,OpenAI 又表示该模型已解决“逾 100 个”其他问题。

