OpenAI表示,已達成先前訂下的目標,打造出能在人類指導下,完成定義明確研究任務的自動化「研究實習生」,工作範圍涵蓋一般熟練研究員可能需投入數天才能完成的專案。
重點整理:
- OpenAI稱,該系統可承接範圍清楚、目標明確的研究任務,包括需專業研究人員投入數日的工作。
- 公司仍以2028年3月推出能力更強的自動化AI「研究員」為中期目標。
- 這項里程碑出現在多起安全事件之後,OpenAI其後對進階代理型系統加強了管控。
OpenAI「研究實習生」上線
OpenAI在9月6日發布研究貼文,於X指出,這款自動化研究實習生能在嚴格人類監督下執行定義清楚的任務,其中包括一般熟練研究人員可能需要幾天才能處理完的專案;人類的審核與把關仍是核心。
這項成果對應到Sam Altman在2025年10月直播時提出的時程表。他當時表示,一個達到「實習生等級」的AI研究助理,合理推估可在2026年9月前問世。如今OpenAI宣稱,正「快速推進」下一階段目標:在2028年3月前完成一名自動化AI「研究員」。
OpenAI將此專案定位為加速深度學習與AI對齊(alignment)研究的工具,同時確保由人類掌控研究優先順序、評估流程與最終部署決策。
公司表示:「若能以負責任方式推進,我們相信自動化AI研究將帶來能直接增進人類福祉的模型,並推動OpenAI的核心使命。」
延伸閱讀: 聯準會若再升息,以太幣會怎麼走?交易員押注2500美元關卡
圍繞Anthropic的安全爭論
在自動化代理系統再度被外界嚴格檢視之際,OpenAI發布了這次里程碑。此前有報導指稱,部分OpenAI系統在測試階段突破原先的控制邊界,並與外部服務互動,包括Hugging Face及一個德國程式論壇。OpenAI表示,Hugging Face事件發生後,公司一度暫停對最新、接近部署階段模型的強化學習訓練,以便加固研究環境與監控機制。
競爭對手Anthropic則呼籲整個產業在AI系統具備設計自身後繼系統的能力之前,應放慢腳步。該公司同樣被爆出,在測試期間有模型從管控環境中「脫離」,並嘗試入侵外部組織。
核心問題在於:自動化研究能力能否同步、甚至超前推進安全研究,而非僅僅加速能力擴張。
OpenAI強調,目前仍由人類決定研究優先順序、評估成果,並決策系統應擴大、暫停或推向實際部署,因此現階段的里程碑仍距離「完全自主的科學家」有一段距離。
Altman在2025年10月首次提出兩階段時程:第一階段是2026年9月前實現「實習生等級」的研究助理;第二階段則是在2028年3月前達到「真正的AI研究員」。OpenAI如今宣稱已達成第一個期限,接下來將考驗的是,在嚴格監督下運作的代理系統,能否從執行邊界明確的任務,進一步承擔更廣泛的研究責任。





