OpenAI開發的AI代理(agents)今年夏天在訓練過程中,自動連上美國三個聯邦政府機構的網站,當中包括一次未遂的教育部網站入侵行動。相關情況由公司及外部研究團隊披露。
重點摘要:
- OpenAI表示,其代理在訓練期間曾造訪美國證券交易委員會(SEC)網站,及讀取人口普查局數據。
- 非牟利研究機構Transluce稱,一個代理曾嘗試入侵教育部旗下網站,但未能成功。
- 最新披露緊接早前對Hugging Face的攻擊,以及對澳洲醫療數據平台被入侵事件之後。
OpenAI代理「掃描」政府機構
OpenAI上周五披露,其AI代理在訓練過程中曾自動存取兩個美國證監會網站上的公開資料,並從屬商務部的人口普查局網站抓取數據。
公司指出,相關行為全部發生於模型訓練階段。非牟利AI研究實驗室Transluce表示,團隊在公開互聯網上發現更多與這些代理相關的技術線索,並已轉交OpenAI跟進。
據報在人口普查局個案中,一個代理曾利用在網上找到的登入憑證進入系統,另一個代理則把證監會的公開資料轉貼到一個網上論壇。OpenAI強調,未見代理實際使用任何SEC登入資料,亦沒有接觸到非公開訊息,更沒有改動該機構系統,並表示已主動通知相關政府部門。
教育部的情況則更進一步。Transluce指,來源看似來自OpenAI的代理,曾嘗試以較原始的手法入侵服務教育部民權辦公室的一個網站,但最終失敗。教育部發言人表示,內部檢查未發現網站或數據庫受到影響的證據。
延伸閱讀:AI真的可以殺死10億人?比爾·蓋茨稱它已具備這種能力
Transluce揭示「灰色地帶」戰術
Transluce負責治理事務的Conrad Stosz表示,這些代理在美國政府網站上使用了「一系列處於灰色地帶的手法」。
該實驗室又指,發現「其他失控活動」,部分未能明確歸因於OpenAI,目標包括司法部及商務部,亦牽涉加州、馬里蘭州、伊利諾伊州、德州及紐約州的州政府網站。
OpenAI的版本則較為溫和。公司稱,大部分行為只是例行研究,原因是其模型普遍把政府網站視為可信的公共資訊來源。OpenAI並補充,向某機構發出通知本身不等同發生了安全事故,並在另一份說明中把這類情況描述為「失衡」(misalignment),可能導致「出乎意料或令人憂慮的行為」。
Hugging Face事件餘波未了
OpenAI行政總裁Sam Altman在X平台表示,公司正就其代理在訓練及評估時如何使用互聯網展開「大規模且持續中的審查」。他並稱,早前針對Hugging Face的網絡攻擊「仍然是我們目前見過最嚴重的事件」。
OpenAI曾把兩個最強大的模型與7月發生的那宗網攻聯繫起來。澳洲總理Anthony Albanese本周三指出,一個OpenAI代理今年6月入侵了澳洲一個Medicare統計數據平台,並批評公司直到9月10日才正式通知澳洲政府,又形容該代理在入侵過程中「不接受拒絕為答案」。

