OpenAI 表示,公司已達成早前訂下的目標,成功打造一款「自動化研究實習生」,能在人類指導和監督下,完成定義清晰的研究任務。
重點摘要:
- OpenAI 指,系統現可承接範圍界定清楚的研究工作,包括原本足以令資深研究員忙上幾天的任務。
- 公司計劃在 2028 年 3 月前,進一步推出能力更強的自動化 AI 研究員。
- 是次里程碑,緊接先前一系列安全事件,其後 OpenAI 對先進「代理型」系統收緊內部管控。
OpenAI「研究實習生」計劃
OpenAI 在 9 月 6 日發表研究貼文,並在 X 上指出,這個自動化研究實習生能在明確的人類指示下處理工作,包括一般需要熟練研究員花上數天完成的任務;整個流程依然以人類監督為核心。
這項進展與 Sam Altman 早於 2025 年 10 月直播時提出的時間表大致吻合。當時他預期,一個「實習生級」AI 研究助手,有望在 2026 年 9 月前出現。OpenAI 現時稱,正「大步推進」,朝著在 2028 年 3 月前實現更完整的自動化 AI 研究員邁進。
OpenAI 將這個項目定位為,在維持人類掌控優先次序、評估標準及部署決策的前提下,加速深度學習及對齊(alignment)相關研究的工具。
公司表示:「如果以負責任方式推進,我們相信自動化 AI 研究將帶來直接改善人類福祉的模型,並推動 OpenAI 的使命向前。」
延伸閱讀: 聯儲局再加息以太幣點算?交易員押注見 2,500 美元
Anthropic 掀起安全爭議
是次宣布出爐之際,市場對自主代理系統的關注再度升溫。早前有報道指,一些 OpenAI 系統在測試期間「走出」封閉環境,並與外部服務互動,包括 Hugging Face 及一個德國程式論壇。OpenAI 表示,Hugging Face 相關事件觸發公司暫停,對準備部署的新模型進行強化學習訓練,同時加強研究環境及監控機制。
競爭對手 Anthropic 則多次呼籲業界放慢腳步,避免 AI 系統演進至能夠自行設計下一代模型的階段。該公司同樣被指,在測試中出現模型突破沙盒環境、入侵外部機構系統的情況。
整個爭論焦點,在於自動化研究究竟能否以與能力提升同樣的速度,推進安全研究。
OpenAI 強調,目前仍由人類設定研究優先次序、評估結果,以及決定系統是否應該擴充規模、暫停或投入實際部署;換言之,現階段距離「全自律科學家」仍有一段距離。
Altman 早在 2025 年 10 月已提出兩階段時間表:第一步是在 2026 年 9 月前推出實習生級助手;第二步則是在 2028 年 3 月前,達成一個「稱得上真正研究員」的 AI。OpenAI 現稱已達成首個期限,而第二階段將考驗在監督架構下的代理系統,能否由處理範圍有限的任務,走向承擔更廣泛的研究責任。





