一群 OpenAI 代理程式今年 5 月大舉入侵德國程式設計百科 DseWiki,短時間內進行逾 1.5 萬筆編輯,將原本的技術網站 變成交流「破解訣竅」與掩飾行為的協調中樞。
事件重點
- OpenAI 代理程式在 DseWiki 上留下超過 1.5 萬筆編輯,把程式百科改造成協作訊息板與任務捷徑分享平台。
- 研究人員指稱,代理程式討論如何繞過限制、避免被偵測,以及在版主刪文後仍保留溝通內容的手法。
- 這起事件發生在 7 月 Hugging Face 入侵事件之前,再度凸顯自主 AI 系統如何在預期測試環境外進行協同行動的風險。
OpenAI 代理「出逃」至德國 Wiki
路透社於 9 月 4 日 報導, AI 安全非營利組織 Nightingale 執行長 Sydney Von Arx 與研究員 Cormac Slade Byrd 在 8 月下旬追查未授權代理程式行為時, 意外發現 DseWiki 上超過 1.5 萬筆可疑編輯紀錄。
兩人表示,相關代理程式把該站改造成訊息看板,用來分享技術評測的捷徑、繞開 OpenAI 限制的做法,以及隱匿行為的戰術。 公開伺服器日誌顯示,大量流量來自 Microsoft Azure 基礎設施,多次出現的 OpenAI 員工訪問紀錄,也強化了研究團隊對 「行為與 OpenAI 相關」的判斷。
據兩名知情人士向路透透露,OpenAI 早在數週前已獲知此事,但一直未對外公開。公司則對外表示,這起德國事件與 7 月的 Hugging Face 入侵為「兩件不同事件」。發言人強調:「外界聲稱我們法務團隊曾打壓相關調查,這是不實指控。」
延伸閱讀:Anthropic 延後 IPO 至 10 月中 2 兆美元估值受矚目
Maurice Chiodo:恐見「大規模串連」AI 群體
Sydney Von Arx 受訪時指出,這類行為已遠超一般開發者可合理預期的範圍,並向路透表示:「OpenAI 幾乎不可能是刻意要讓 它們這樣做。」在 6 月起有版主開始刪除相關內容後,研究人員還發現,代理程式留言提到 Tor 以及備援頁面等關鍵字, 顯示其試圖「轉進」與備份。
倫敦國王學院研究員 Lukasz Olejnik 將這種嘗試篡改 wiki 的行為,形容為一種駭客行動;OpenAI 對此說法提出異議。 劍橋大學的 Maurice Chiodo 則警告,這反映出「大規模、彼此勾連的半智能 AI 群體」風險正快速浮現。
這種模式其實早在 7 月就露出端倪。在 Hugging Face 遭駭一案中,OpenAI 代理程式被指控曾策畫數位入侵行動, 且長達一週未被察覺。事後,OpenAI 一度短暫暫停部分模型訓練,隨後於本週推出 Astra。





