今年夏天,OpenAI 所打造的 AI 代理(agents)在訓練過程中,實際連上三個美國聯邦機構所管理的網站,其中包括一次針對教育部網站的未遂入侵。這些情況由 OpenAI 與外部研究機構相繼對外披露。
重點整理:
- OpenAI 表示,其代理在訓練執行時曾存取美國證券交易委員會(SEC)網站與人口普查局資料。
- 研究機構 Transluce 指出,一個代理曾嘗試入侵教育部網站但未成功。
- 此次揭露緊接在 7 月 Hugging Face 遭攻擊、以及 6 月澳洲健康資料入口被駭事件之後。
OpenAI 代理探測美國聯邦機構
OpenAI 週五對外說明,其 AI 代理在訓練過程中,曾連上兩個 SEC 官方網站並存取公開資訊,同時也曾從隸屬商務部的人口普查局網站擷取資料。
公司表示,相關行為發生在模型訓練執行階段。非營利 AI 研究實驗室 Transluce 則稱,他們在自行調查期間,在公開網路上發現更多與這些代理相關的線索,並已回報給 OpenAI。
根據報導,在人口普查局個案中,一個代理曾利用其於網路上找到的登入憑證登入系統,另一個代理則把 SEC 的公開資料轉貼到某個線上論壇。OpenAI 強調,並未發現代理有使用任何 SEC 登入憑證、也沒有接觸到非公開資訊,更未改動該機構的系統,同時已主動通知相關主管機關。
教育部案例則更往前一步。Transluce 指出,一些被判定疑似源自 OpenAI 的代理,曾對教育部民權辦公室所使用的網站發動基礎層級的駭客嘗試,但最終失敗。教育部發言人表示,內部檢查並未發現網站或資料庫受到任何影響。
延伸閱讀: AI 真的能殺 10 億人?比爾蓋茲:技術已具備這種威力
Transluce:代理採用「灰色地帶」戰術
Transluce 治理部門負責人 Conrad Stosz 在接受訪問時指出,這些代理在美國政府網站上使用了「一連串踩在灰色地帶的手法」。
該實驗室同時通報,發現「其他疑似異常行為」,其中部分無法明確歸因於 OpenAI,攻擊目標包含司法部、商務部,以及加州、馬里蘭州、伊利諾州、德州與紐約州等州級政府網站。
相比之下,OpenAI 對外說法顯得較為保守。公司稱,多數操作屬於一般研究行為,主要因模型傾向把政府網站視為權威的公共資訊來源。OpenAI 也補充,通知某個機構並不代表已發生具體資安事件,並在官方說明中將這類情況定義為「模型失準」(misalignment),可能導致「出人意料或令人擔憂的行為」。
Hugging Face 事件陰影猶在
OpenAI 執行長 Sam Altman 在 X 上表示,公司正進行「大規模且持續的檢討」,回溯代理在訓練與評估階段如何使用網路。他同時形容,7 月針對 Hugging Face 的網攻「仍是迄今最嚴重的一次事件」。
OpenAI 先前已將該起 7 月網攻,與旗下兩款最強大模型連結起來。澳洲總理 Anthony Albanese 週三則透露,今年 6 月,一個 OpenAI 代理曾突破澳洲 Medicare 統計資料入口。他批評 OpenAI 直到 9 月 10 日才正式通知澳洲政府,並形容該代理「不會接受被拒絕這個答案」。
下一步閱讀: Paxos 推出與黃金租賃收益掛鉤的 PAXGy

