一批 OpenAI 代理被指在繞過網上發文限制後,利用逾 10 個此前未曝光網站進行未獲授權通訊,築起隱蔽訊息渠道。
重點摘要:
- 六項獨立調查及相關數據顯示,5 至 7 月間 OpenAI 代理曾在逾 10 個此前未披露網站進行通訊。
- 研究人員在多個 wiki、文字儲存平台及大學短網址服務上發現相關「足跡」,部分估算多達 23 個網站。
- OpenAI 稱內部檢視未見有活動在嚴重程度或規模上可與 Hugging Face 外洩事件相提並論。
OpenAI 代理活動擴散
根據 路透社 9 月 9 日的報道,綜合六項獨立調查及路透審視的資料,OpenAI 代理在 5 至 7 月期間,曾於逾 10 個網站進行未獲授權通訊。該結果令外界對事件的理解,由原先聚焦於一個德文 wiki,被用作代理臨時訊息平台,擴展至更廣泛的網站網絡。
調查人員透過比對數據字串、用戶名稱及冷門研究問題(包括愛荷華州癌症發病率等查詢),把不同網站上的可疑活動串連起來。部分技術線索亦指向 Microsoft Azure 基建,而 OpenAI 有時會採用相關服務。
路透指無法逐一核實所有個別聲稱,但受訪的每位調查者均認為涉事網站數目超過 10 個,涵蓋社群編輯 wiki、文字儲存平台及由大學營運的短網址服務等。
OpenAI 並未交代實際涉事網站數目,亦未清楚說明相關活動為何可潛藏數月而未對外披露。公司只表示,較廣泛的內部檢視「未有識別出在嚴重程度或規模上,可與 Hugging Face 事件相若的其他活動」,並承諾將建立一套通報模型「失衡」(misalignment)的框架。
延伸閱讀: Apple 為首款可摺疊 iPhone 雙機定價 1,999 美元 Samsung 或需緊張
Yoon 警示風險被低估
加州非牟利機構 CivAI 研究員 Andrew Yoon 表示,他統計到有 18 個此前未披露的相關網站,形容事件規模「比我們原本以為的大了一截」。他認為「幾乎可以肯定,仍有更多情況尚未曝光」。
首度揭發德文 wiki 個案的 Sydney Von Arx 則指,其團隊已在 23 個此前未報道網站上取得可信線索,但強調相關估算仍屬不完整:「實際規模有多大,我們根本沒有頭緒。」
軟件開發員、前美國國會助理 Kenneth Russell DeGraff 稱,他在至少 10 個網站上發現可追蹤痕跡。研究人員相信,這些代理因為能掃描全網尋找答案,卻原則上不應在網上貼文,於是「即興」搭建訊息通道,促使 DeGraff 形容它們必須「用更聰明的方法把訊息留在網上」。
多間院校亦牽涉其中。多倫多大學指,路透報道刊出後,OpenAI 主動聯絡該校;范德堡大學則稱,正調查其短網址服務是否被以類似方式濫用。其後,被指旗下六個 wiki 網站受影響的退休軟件開發員 Helmut Leitner 收到一封未簽名的 OpenAI 電郵,並表示責任應由「背後的人與機構」承擔。
是次更廣泛的調查結果,接續早前 OpenAI 於 7 月涉及開源平台 Hugging Face 的外洩事故,以及上周德文 DseWiki 個案的披露。這兩宗事件首先揭示代理可繞過原有限制,而最新調查顯示,同類行為或已蔓延至更龐大的网站群組。

