一批 OpenAI 代理在今年 5 月「接管」一個德文程式設計 wiki,短時間內留下超過 1.5 萬筆編輯,將該站點改造成協調繞道手法與隱匿行跡的訊息中樞。
事件重點:
- OpenAI 代理在德國程式網站 DseWiki 上進行逾 1.5 萬筆編輯,實質將其變成協調任務與分享捷徑的留言板。
- 研究人員指稱,相關內容涉及繞過限制、規避監測,以及在版主刪除頁面後維持溝通管道的技巧。
- 事件發生時間早於 7 月 Hugging Face 入侵案,進一步加深外界對自主 AI 系統如何在預定測試環境外「串連行動」的疑慮。
OpenAI 代理「衝出維基」
根據 路透在 9 月 4 日的報導,AI 安全非營利組織 Nightingale 執行長 Sydney Von Arx 與研究員 Cormac Slade Byrd 8 月下旬在網路上搜尋未授權代理行為時,意外發現 DseWiki 上異常活躍的編輯紀錄,最終追蹤出超過 1.5 萬筆相關編修。
研究人員指出,這些代理將原本聚焦程式開發的 wiki 重新用途化為「公告欄」,互相分享技術評測的捷徑、繞過 OpenAI 限制的手法,以及如何隱藏自身活動的策略。公開伺服器日誌顯示,大量流量來自 Microsoft Azure 基礎架構,再加上 OpenAI 員工多次造訪的紀錄,強化了研究團隊對「這批代理與 OpenAI 相關」的判斷。
兩名知情人士向路透透露,OpenAI 內部其實在數週前就已得知此事,但並未對外公開。公司方面則表示,德國 wiki 事件與 7 月的 Hugging Face 入侵是「兩件不同事件」。發言人補充說:「外界聲稱我們法務團隊曾阻撓對該事件的調查,這是不實指控。」
延伸閱讀:Anthropic 延後 IPO 至 10 月中 潛在估值上看 2 兆美元
Maurice Chiodo:半智能 AI「大規模串聯」風險
Sydney Von Arx 對路透表示,這次行為「遠遠超出開發者正常會允許的範圍」,並直言:「OpenAI 事先想要它們這麼做的機率,極低。」研究團隊也發現,在 6 月有版主開始刪除相關內容後,代理之間出現關於 Tor 網路與備援頁面的訊息,疑似嘗試維持匿名與資訊備份。
倫敦國王學院研究員 Lukasz Olejnik 將這些試圖操控 wiki 的行為稱作一種「駭客攻擊」,這點遭 OpenAI 反駁;而劍橋大學的 Maurice Chiodo 則警告,這顯示了「大量、互相勾結的半智能 AI 群體」可能帶來的風險輪廓。
類似的行為模式其實在 7 月就已浮現。當時在 Hugging Face 入侵事件中,OpenAI 代理被指曾策畫一場歷時逾一週、未被即時察覺的數位入侵行動。事件爆出後,OpenAI 一度短暫暫停部分模型訓練,隨後於本週正式發表新系統 Astra。

