OpenAI 週二公開一批由尚未對外開放的內部 AI 模型產出的數學研究成果,共 722 篇手稿、歸類為 372 組「結果家族」,並將判斷權交還給全球數學界,看這批成果究竟有多少經得起專業檢驗,也是否符合先前提出的釋出準則。
重點整理:
- OpenAI 在 GitHub 上發布 722 篇論文手稿、分屬 372 個「家族」,全部由一款外界無法使用的內部模型生成。
- 由 9 位數學家組成的獨立顧問團強調,參與並不代表認可這批結果,更不是對 OpenAI 研究流程的背書。
- OpenAI 承認,部分尚未經電腦形式驗證的結果,可能存在錯誤或瑕疵。
OpenAI 數學成果一次攤開
OpenAI 將這批成果公開於一個對外開放的 GitHub 儲存庫,並訂出未來若要修訂或引用這些論文時應遵守的規則。該儲存庫在頁面中列出 722 篇手稿,分為 372 個「家族」:每一個家族包含一個主要結果,以及相關的輔助論證、推論結果或替代證明。
OpenAI 表示,團隊總共向這套模型提出約 4,000 個數學問題,最後只保留其內部評估為「具有足夠重要性」的成果。
按公司說法,每項結果平均耗費約 3 小時的 ChatGPT Pro 計算資源。許多證明同時附有以 Lean 程式語言撰寫的形式化版本,讓電腦可以自動檢查證明是否嚴謹正確。
不過,OpenAI 也坦言,那些尚未經過 Lean 等工具形式驗證的結果,仍可能存在錯漏或邏輯缺陷。
延伸閱讀:北韓駭客組織 Lazarus 涉將竊得 10 億美元洗入中國,ZachXBT 指控
顧問團畫清界線:不替結果背書
這次釋出也牽涉一個名為「數學與人工智慧顧問團」(Advisory Group on Mathematics and Artificial Intelligence)的獨立小組。該團隊由 9 位無給職數學家組成,由高等研究院(Institute for Advanced Study)負責召集。顧問團在公開聲明中強調,他們的角色既不是替這批結果評分,也不是替 OpenAI 的研究與發布流程背書。
顧問團指出,究竟 OpenAI 在多大程度上遵守了他們的建議,最終仍要由更廣大的數學社群來裁決,而不是由少數受邀顧問來定調。
這些建議早在 9 月 29 日就已發布,內容包括:要求 AI 實驗室完整引用既有文獻、以傳統學術論文的格式撰寫證明、公開提示詞(prompts)、推理摘要與計算成本;同時強調,研究成果應優先存放於不受任一 AI 公司控制的學術典藏平台。OpenAI 表示,目前仍在評估由社群主導、取代 GitHub 的其他方案,並承諾出資支持針對重大 AI 數學成果舉辦工作坊。
顧問團成員之一、哈佛大學數學系教授 Melanie Matchett Wood 早在 9 月就曾警告,AI 產出的數學內容「往往涉及抄襲」,而且通常找不到願意為結果負責的人類作者。她提醒,這對學術倫理與責任歸屬構成實質挑戰。
與此同時,OpenAI 發言人也在另一篇專訪中承認,連公司內部的數學家,目前都尚未真正理解這批新成果中的許多論證與結論。
Navier–Stokes 爭議延燒
這次大規模釋出,正是過去一個月 OpenAI 與數學界摩擦升溫的延續。9 月 8 日,OpenAI 對外宣稱,自家模型解出了號稱懸賞 100 萬美元的 Navier–Stokes 千禧難題,隨即與紐約大學數學家 Tristan Buckmaster 爆發功勞歸屬爭議。
僅僅三天後,25 位費爾茲獎得主聯名簽署聲明,反對將這類享譽盛名的未解難題當作 AI 模型的「表演舞台」與基準測試。9 月 21 日,OpenAI 又表示,自家模型已經解決逾 100 題其他數學難題,使爭議持續延燒。

