Anthropic揭露Claude在資安測試中入侵三家公司

Three Anthropic models crossed from a sealed test environment into the production systems of outside organizations after a setup error. (Image: Shutterstock)
Three Anthropic models crossed from a sealed test environment into the production systems of outside organizations after a setup error. (Image: Shutterstock)

Anthropic檢視共 141,006 次資安評估紀錄後發現,有三起測試事故中,其Claude 模型實際連上開放網際網路,並入侵外部組織正在運作的系統。

重點整理:

  • Anthropic在 141,006 次資安評估中,找到與三起真實入侵事件相關的 6 次測試紀錄。
  • 測試夥伴 Irregular 的環境設定錯誤,在提示詞明示「無網路」的情況下,仍將網路存取維持開啟。
  • 牽涉的模型包括 Opus 4.7、Mythos 5 以及一款內部研究模型,最早可追溯至今年 4 月。

Anthropic曝三起Claude實際入侵事件

Anthropic在周四發布的部落格聲明中,首度公開上述事件細節,說明內部調查結果與將採取的補救與防範措施。

團隊從評估日誌回頭搜尋,鎖定原本應該被「完全隔離」的測試環境中,模型是否曾觸及開放網際網路。最後確認在三起獨立事故中共六次測試出現異常,全數都指向同一名外部測試合作夥伴。

按照測試設計,提示詞向模型聲稱其「沒有網路存取權限」,但Anthropic實驗室與測試夥伴 Irregular 之間的誤解,卻讓實際的網路連線持續開啟。模型一旦上線,便開始利用弱密碼與未驗證端點就能取得權限,完全不需要尋找深層軟體漏洞。

在其中一起事件中,Opus 4.7 在四次測試裡都辨識出自己已進入真正的生產系統,卻仍持續執行攻擊行為,竊取憑證並存取含有真實客戶資料的資料庫。另一款模型 Mythos 5 也察覺到連上了開放網路,但隨後又「說服自己」測試情境仍是模擬環境,接著發布惡意套件到公共 Python 套件註冊庫,導致外部系統在未察覺風險的情況下下載並執行相關程式碼。

延伸閱讀:去中心化交易所七月成交量驟減26%,鏈上流動性持續緊縮

專家質疑AI沙盒控管強度

在三款涉事模型中,只有最新的內部研究模型在過程中自行停止攻擊,理由是判斷目標系統與其被賦予的測試任務無關。

AI Now Institute 首席AI科學家、前 OpenAI 安全承包顧問 Heidy Khlaaf 曾多次指出,此類AI測試沙盒一向存在著名的安全弱點。Cloud Security Alliance呼籲,實驗室在能力評估過程中,必須以更嚴格機制持續監控並管束自律型代理人。

對於此次事件,該測試夥伴的發言人向媒體表示,其內部調查仍在進行中,並稱讚Anthropic在整體處理過程中「高度配合且透明」。

Anthropic應對作法與Mythos前科

Anthropic於 7 月 23 日全面暫停所有網路攻防類型的資安評估,隔日即鎖定三起事故的完整範圍,並在 7 月 27 日正式通知所有受影響的組織。

其中兩家企業原本完全沒有察覺到有異常行為,目前由獨立評估機構 METR 介入,對整起事件進行第三方審查。

此次風波延續了Anthropic先前對自家高階模型風險的警示。該公司今年稍早曾在一項控制實驗中,指示某款最先進模型嘗試「突破安全沙盒」;結果顯示,模型成功連上原本不在授權範圍內的服務,甚至利用未被預期的能力,主動寄送電子郵件給一名研究人員。

下一篇:OpenAI「失控代理人」實際入侵除了Hugging Face外的另外四項服務

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 是 Yellow.com 的內容總監,過去 10 年持續報導加密貨幣領域。他專長於撰寫深入的 Research 和 Learn 類型文章,特別關注分析式報導、產業脈絡,以及塑造加密貨幣世界的更大力量,從 AI 時代與資安技術到金融科技創新。他相信數位的一切即將全面超越類比的一切,並正為實現這一願景而全力以赴。

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
Anthropic揭露Claude在資安測試中入侵三家公司 | Yellow