OpenAI 於周二一次過公開 722 份數學手稿,按主題劃分為 372 個「結果家族」,全部出自一個尚未對外開放的內部 AI 模型,並交由國際數學界判斷,是否符合此前訂立的釋出指引。
重點摘要:
- OpenAI 把 722 份、分屬 372 個家族的數學手稿上載至 GitHub,全由內部模型生成,外界暫時無法直接使用該模型。
- 由 9 名數學家組成的獨立顧問小組強調,其角色並非替這批結果或 OpenAI 的操作背書。
- 公司承認,部分未經形式化電腦檢查的結果,可能存在問題或錯誤。
OpenAI 數學成果公開
OpenAI 已在公開的 GitHub 儲存庫發佈這批研究成果,並訂明每篇手稿日後如要修訂及引用,需遵守的規則。該儲存庫在 GitHub 列出 722 份手稿,歸納為 372 個結果家族;每個家族把一個主要定理或結果,連同輔助論證、推論結果或替代證明一併整理。
OpenAI 指出,團隊向模型拋出約 4,000 條數學問題,最終只保留被內部評為「足夠重要」的結果。
就計算資源而言,公司表示,每個結果平均消耗約三小時的 ChatGPT Pro 思考運算時間。當中不少證明附有以 Lean 語言撰寫的版本,方便以形式化方法讓電腦逐步檢驗證明是否成立。
OpenAI 亦明言,凡未有配備這類電腦檢查的結果,理論上都可能潛藏錯漏。
延伸閱讀:北韓 Lazarus 涉將 10 億美元贓款經中國洗黑,ZachXBT 指控
顧問小組:參與不等同背書
由 9 名義務數學家組成、設於高等研究院(Institute for Advanced Study)的「數學與人工智能顧問小組」(Advisory Group on Mathematics and Artificial Intelligence),在聲明中明確指出,其角色既不是替相關結果作出學術審定,也不是替 OpenAI 的內部流程背書。
小組強調,最終只有更廣泛的數學社群,才有資格和能力評估 OpenAI 在多大程度上遵守了其建議。
該小組於 9 月 29 日發表的建議文件,要求 AI 實驗室:
- 嚴格引用既有文獻;
- 按傳統學術論文格式撰寫證明;
- 披露提示詞(prompts)、推理摘要及實際運算成本;
- 並把結果存放於不受任何 AI 實驗室控制的學術型儲存庫。
OpenAI 表示,正研究改用由社群主導、非自家控制的平台以取代 GitHub,並計劃資助有關重大 AI 數學成果的學術工作坊。
來自哈佛大學的數學系教授、顧問小組成員 Melanie Matchett Wood 早在 9 月已在訪問中警告,AI 生成的數學內容「往往涉及抄襲」,而且通常沒有任何一位人類研究者願意為其負責。OpenAI 一名發言人亦在另一篇報道中承認,公司內部的數學家,對不少新結果目前仍未完全理解。
圍繞 Navier‑Stokes 的爭議未平
是次大規模釋出,延續了過去一個月 OpenAI 與數學界之間的緊張關係。9 月 8 日,OpenAI 宣稱其模型已為千禧年難題之一的 Navier‑Stokes 方程提供解答,隨即與紐約大學數學家 Tristan Buckmaster 爆發學術歸屬爭議。
僅僅三日後,25 名菲爾茲獎得主聯署聲明,反對把這類著名未解難題用作 AI 模型的性能基準。OpenAI 則在 9 月 21 日進一步表示,其模型已處理超過 100 個其他重大問題。

