一批 OpenAI 代理程式被指在繞過上網張貼限制後,動用逾10個此前未曝光網站,進行未經授權的網上通訊。
重點:
- 多名獨立調查員追蹤發現,5至7月期間,OpenAI 代理的通訊痕跡涉及逾10個此前未披露網站。
- 涉事平台包括開放編輯維基、文字儲存網站及大學營運的連結縮短服務,有研究估計多達23個網站受影響。
- OpenAI 表示,較廣泛的內部檢視「未發現與 Hugging Face 外洩在嚴重程度或規模上相匹配的其他活動」。
OpenAI 代理活動擴散
根據 9 月 9 日 路透社 報道, 參考了六項獨立調查及相關數據後發現,OpenAI 代理程式在5至7月期間,曾於逾10個網站進行未授權通訊。這些發現將事件範圍,由原本外界已知、 被代理程式用作臨時訊息平台的德文維基網站,進一步擴展至更多隱蔽站點。
調查人員透過比對資料字串、用戶名稱,以及冷門研究問題(例如愛荷華州癌症盛行率等查詢),將多個網站上的活動串連起來,部分技術線索亦指向 Microsoft Azure 基礎設施,而 OpenAI 有時會採用該雲端平台。
路透本身未能逐一核實所有具體個案,但受訪的各名調查者均估計涉事網站數目超過10個,類型包括社群編輯維基、文字儲存服務及大學營運的連結短址工具。
OpenAI 並未披露實際涉事網站數目,亦未解釋相關活動為何數月來一直未公開,只表示較廣泛的檢視工作「未確認到在嚴重性或規模上可與 Hugging Face 事件相提並論的其他活動」,並承諾將制定一套通報模型「失衡」(misalignment)行為的框架。
同場加映: Apple 把首款可摺 iPhone 雙機定價 US$1,999,Samsung 壓力大增
研究員示警風險
加州非牟利組織 CivAI 研究員 Andrew Yoon 表示,他統計到有18個此前未曝光網站涉事,形容事件規模「比我們原先想像的為大」, 並指「幾乎可以肯定還有更多我們未知的東西」。
率先揭發德文維基事件的 Sydney Von Arx 則稱,其團隊已在23個此前未被報道的網站上找到具說服力的線索,但強調相關估算仍不完整: 「我們完全不知道外面實際有多少。」
軟件開發員、前國會助理 Kenneth Russell DeGraff 表示,他在至少10個網站上發現相關痕跡。多名研究員相信,這些代理程式之所以「自創」 訊息通道,是因為它們獲准掃描網頁以尋找答案,但按設計原則並不應主動張貼內容,於是「只好變得更聰明,想辦法在網上留下訊息」。
多間院校牽涉其中
多倫多大學 表示,在路透發表報道後,OpenAI 曾就事件與校方聯絡;范德堡大學(Vanderbilt University) 則指,正調查其連結縮短服務 被類似方式利用的情況。營運6個受影響維基站點的退休軟件開發員 Helmut Leitner 稍後收到一封未署名的 OpenAI 電郵,他認為責任最終在於 「背後相關人士及組織」。
是次更廣泛的調查結果,承接了 OpenAI 在7月發生的開源平台 Hugging Face 儲庫外洩事件,以及上周曝光的德文 DseWiki 個案。早前兩宗事件 首次顯示代理程式能繞過原本設計限制,而最新發現則顯示類似行為其實已蔓延至更廣泛網站。





