維基媒體基金會(The Wikimedia Foundation)作為擁有約 6,700 萬篇條目的維基百科東家表示,其認為由 OpenAI 運行的 AI 代理程式曾在未獲授權下修改多個維基專案內容,並可能與今年 5 月的一次服務中斷事件有關。
重點摘要:
- 維基媒體稱,疑與 OpenAI 有關的代理程式進行了未經批准的編輯,幾乎全部發生在讀者看不到的「沙盒」區域。
- 高強度代理程式流量,可能是 5 月維基數據查詢服務(Wikidata Query Service)部分當機的原因之一。
- 基金會表示,尚未發現系統或資料遭入侵的證據;OpenAI 則稱正協助分析相關活動。
OpenAI 代理程式現蹤維基專案
維基媒體基金會首席產品與技術長 Selena Deckelmann 週一在一篇部落格文章中表示,內部調查發現其平台上存在三類未授權活動。
幾乎所有修改行為都發生在對一般讀者隱藏的沙盒區域,屬測試性質。不過也有少數操作試圖變更一款引文工具的設定,基金會認為這可能是企圖藉該工具從外部抓取資料。依維基百科現行規則,社群審核通過的機器人方可上線運作,但上述代理程式並未事先申請或獲得批准。
相關代理程式同樣曾嘗試濫用基金會架設的公開協作筆記工具 Etherpad,以類似方式取得外部資料,但最終未成功;也有代理程式在 Etherpad 留下任務備忘錄,卻未見實際協調或後續行動成形。基金會指出,這些代理程式另外還抓取了數以百萬計的頁面,主要集中在維基數據(Wikidata)與維基共享資源(Wikimedia Commons),並向維基數據查詢服務送出數十萬筆查詢流量,這類高負載請求可能促成了該服務在 5 月出現部分中斷。
調查結果顯示,暫未有證據顯示這些代理程式成功突破維基媒體的系統防線,亦未發現資料遭竄改或外洩。
延伸閱讀:幣安 AI 代理從自然語言打造交易策略,每筆交易收取 19.99 USDC
Deckelmann 批評 AI 業者「未盡責任」
Deckelmann 在文中強調,開放網路屬於「公共財」,但她認為當前多數 AI 公司「在保護自家系統與公共安全方面做得遠遠不夠」,相關風險正被轉嫁給其他利害關係人,尤其是規模較小的組織。
在她看來,最低限度是:AI 系統的運作方式必須讓非營利網站經營者能清楚識別並辨認其流量來源,並有權選擇是否、以及如何與這些代理程式互動。
OpenAI 在一份聲明中表示,感謝維基媒體提供「詳盡的調查結果」,並正與其合作分析活動軌跡。「隨著相關工作推進,我們將持續分享必要資訊。」OpenAI 發言人 Drew Pusateri 指出。
OpenAI 代理程式風險持續升溫
事實上,維基媒體承受 AI 流量壓力並非始於此次事件。基金會早在 2025 年便指出,自 2024 年以來的機器人活動已令其頻寬使用暴增約 50%,其中 65% 的高資源消耗流量來自各類機器人。
在上週的美國參議院聽證會上,兩黨議員提出,未來應考慮讓 AI 公司為其代理程式造成的損害承擔法律責任。
維基媒體這次的調查結果,接續了過去數月有關 OpenAI 代理程式的一連串披露。包括 OpenAI 今年 7 月承認,其模型在執行網路安全任務時,曾入侵 AI 平台 Hugging Face 的案例。加州檢察總長 Rob Bonta 則於 10 月 1 日向 OpenAI 發出傳票,要求交代多起與其模型相關的網路安全事件。
研究人員上週亦指出,OpenAI 代理程式曾從逾 50 家企業、非營利組織與政府機構網站抓取資料,凸顯其產品在「自主行為」與「安全邊界」之間的落差。

