OpenAI 表示,已達成先前設定的里程碑:一款能在人類指導下,完成定義清楚研究任務的「自動化研究實習生」。
重點整理:
- OpenAI 指出,該系統可承接範圍明確的研究任務,包括原本可能要佔用專業研究員好幾天的工作。
- 公司仍以 2028 年 3 月為目標,打造能力更完整的自動化 AI 研究員。
- 這項進展出現在多起安全事故之後,OpenAI 隨後收緊了對高階代理型系統的控管。
OpenAI「研究實習生」上線
在 9 月 6 日發布的研究貼文中,OpenAI 表示,這套自動化研究實習生可以在明確的人類指令下運作,處理定義清楚的任務,包括那些原本需要熟練研究員花上數天完成的工作;人類監督仍是核心設計。
這個里程碑呼應 Sam Altman 在 2025 年 10 月直播時提出的時間表——當時他預估,一個「實習生等級」的 AI 研究助理,合理情況下可能在 2026 年 9 月出現。OpenAI 現在表示,正「大幅推進」朝 2028 年 3 月前實現自動化 AI 研究員的目標前進。
OpenAI 將此計畫定位為,在維持人類掌控優先順序、評估與部署決策的前提下,加速深度學習與對齊(alignment)相關研究。
公司強調:「若以負責任的方式推進,我們相信自動化 AI 研究將催生能直接提升人類福祉的模型,並推動 OpenAI 的使命。」
延伸閱讀: 若聯準會升息,以太幣會怎麼走?交易員押注 2,500 美元價位
與 Anthropic 的安全攻防
這項宣布出現在自動化代理系統再度遭到外界嚴格檢視之時。先前有報導指稱,部分 OpenAI 系統曾突破測試環境限制,對外連線並與 Hugging Face 及德國某程式論壇等外部服務互動。OpenAI 表示,Hugging Face 事件發生後,公司一度暫停對最新、接近部署階段模型的強化學習訓練,同時強化研究環境與監控機制。
競爭對手 Anthropic 則呼籲產業在 AI 系統具備自行設計下一代模型能力之前,應放緩開發腳步。Anthropic 自身也曾被曝出,測試過程中模型脫離管控環境、嘗試入侵外部組織的案例。
更大的爭議在於:自動化研究是否真能讓安全研究的進度,跟得上模型能力不斷躍升的速度。
OpenAI 強調,目前仍由人類負責設定研究優先順序、評估研究結果,並決定系統應該擴大規模、暫停,或正式部署,因此這次的里程碑距離「完全自主的 AI 科學家」仍有一段距離。
Altman 最早在 2025 年 10 月提出兩階段時間表:先在 2026 年 9 月前推出一款「實習生等級」助理,接著在 2028 年 3 月前達成「真正的 AI 研究員」。OpenAI 現在宣稱已達成第一階段目標;至於第二階段,將考驗在有人監督前提下運作的代理系統,能否從處理邊界清楚的任務,進一步承擔更廣泛的研究責任。





