維基媒體基金會(The Wikimedia Foundation)身為收錄逾 6,700 萬篇條目的維基百科營運單位表示,疑似由 OpenAI 操作的 AI 代理程式,曾在未經授權情況下編輯其多個維基專案,並可能與今年 5 月一度發生的服務中斷事件有關。
重點整理:
- 維基媒體指出,疑似由 OpenAI 操作的代理程式進行未經批准的編輯,多數集中在一般讀者看不到的沙盒區。
- 大量代理程式流量,可能促成 5 月間 Wikidata 查詢服務(Wikidata Query Service)的部分當機。
- 基金會未發現系統或資料遭入侵跡象;OpenAI 則表示正協助分析相關活動。
OpenAI 代理程式現蹤維基專案
維基媒體基金會產品與技術長 Selena Deckelmann 於週一在部落格發文指出,內部調查發現平台上出現三種類型的未經授權活動。
幾乎所有編輯都發生在僅供測試、一般讀者不會看到的沙盒區域;但少數操作則變更了某項引用工具的設定,基金會研判,該行為疑似嘗試透過此工具抓取外部資料。依維基百科既有規則,機器人帳號必須經社群審核同意方可運作,但這批代理程式並未申請或獲得任何形式的批准。
調查還發現,這些代理程式曾嘗試誤用基金會架設的公開協作筆記工具 Etherpad,以類似方式存取外部資料,所幸並未成功;另有部分代理程式在 Etherpad 留下任務備註,但看不出有進一步協調行動的跡象。
同時,代理程式曾大量爬取數以百萬計的頁面,主要集中在 Wikidata 與 Wikimedia Commons,並向 Wikidata 查詢服務送出數十萬筆查詢請求。基金會表示,這類高強度流量可能是 5 月該服務部分中斷的因素之一。
目前的調查結果顯示,尚未發現代理程式成功入侵維基媒體的系統或竄改底層資料庫。
延伸閱讀:幣安 AI 代理程式用白話替你下單,一次交易收 19.99 USDC
Deckelmann:AI 公司沒盡到安全責任
Deckelmann 在文中強調,開放網路是「公共財」,但 AI 公司「在保護自家系統與大眾免受傷害方面做得遠遠不夠」。她指出,這項風險已被外溢到其他人頭上,特別是資源有限的中小型組織。
她主張,至少在最低標準上,AI 系統應該以一種方式運作:讓非營利網站營運者能清楚識別代理程式流量,並自行決定要如何與這些系統互動,包含是否阻擋或限制。
OpenAI 在一份聲明中表示,感謝維基媒體基金會提供「詳盡的調查發現」,並正在與對方合作分析相關活動。發言人 Drew Pusateri 表示:「隨著調查進展,我們會持續分享相關資訊。」
OpenAI 代理程式持續遭外界放大檢視
對維基媒體基礎設施造成壓力的問題,早在這次調查之前就已浮現。基金會在 2025 年曾報告,自 2024 年以來,機器人相關活動已令其頻寬使用量增加 50%,且在最耗資源的流量中,約 65% 來自各式自動化程式。
在上週一場美國參議院聽證會中,兩黨議員提出構想,討論是否應讓 AI 公司為其代理程式造成的損害承擔法律責任。
維基媒體的最新調查結果,緊接在 OpenAI 代理程式一連串爭議之後。OpenAI 今年 7 月曾公開表示,其模型在執行網路資安任務時,曾入侵 AI 平台 Hugging Face;加州檢察總長 Rob Bonta 則於 10 月 1 日傳喚 OpenAI,要求就多起與其模型相關的網路資安事件作出說明。
研究人員上週進一步指出,相關代理程式已從逾 50 個商業、非營利與政府網站抓取資料,涉及範圍持續擴大。

