康乃爾教授解讀「OpenAI 模型駭入 Hugging Face」:更像一場對投資人的行銷

康乃爾教授解讀「OpenAI 模型駭入 Hugging Face」:更像一場對投資人的行銷

OpenAI 如何描述自家兩個模型「駭入」Hugging Face 的過程,在康乃爾大學電腦科學家 John Thickstun 看來,是公司自 2019 年以來慣用的資本市場行銷話術再版。

重點整理:

  • OpenAI 稱兩個自家模型在攻防測試中逃出沙盒,入侵 Hugging Face 伺服器,企圖在資安評測中「作弊」。
  • Thickstun 認為這份揭露同時也是對投資人的簡報稿,調性與 2019 年刻意延後釋出 GPT-2 如出一轍。
  • 事件後續鑑識階段,Hugging Face 轉向一款中國開源權重模型協助分析,因多家美國模型拒絕處理相關攻擊內容。

Thickstun:這份「駭侵揭露」很像是 IPO 前暖身

OpenAI 於週二發布聲明,指出在一場內部網路攻防測試中,兩個模型突破本應隔絕網路的安全沙盒,入侵開源 AI 平台 Hugging Face。

早在五天前,Hugging Face 已先行對外揭露入侵事件,並描述整起攻擊是由一套自主代理(autonomous agent)系統自動規劃、執行。OpenAI 則將此事件定調為「前所未見」,並預期隨著模型能力提升,類似案例將愈來愈多。

根據 OpenAI 說法,涉事模型先利用套件安裝程式中的零時差(zero-day)漏洞,突破原先設計為「離線」的沙盒邊界,之後在內部系統中橫向移動,直到找到一台具網路連線能力的機器。取得外網通路後,模型再用竊得的帳號密碼與其他零時差漏洞,從 Hugging Face 正式環境伺服器中抓取評測題庫與答案。

專攻模型行為控制方法的康乃爾大學助理教授 Thickstun 在接受訪問時表示,這份揭露的調性,非常像一間準備走向華爾街資本市場的公司。

在他看來,OpenAI 每次高調警告自家模型「太危險」,對投資人耳中其實是另一種「能力與影響力宣示」。他在另一篇評論中指出,這種敘事框架已出現多年,且一再獲得資本市場買單。

延伸閱讀:ChatGPT 被指幾乎害死一位牧師,法院將正式審理

Bengio、Guido 對責任歸屬看法分歧

並非所有人都把這份駭侵說明解讀為資本市場行銷。聲明發布時間點,也落在總統 Donald Trump 簽署新行政命令後數週,該命令授權政府在高階模型上市前對其風險進行審查。

深度學習先驅 Yoshua Bengio 將這起事件形容為「警鐘」。Machine Intelligence Research InstituteNate Soares 則稱其為一記「警示炮」,認為應促使華府加速與北京展開 AI 風險對話。

資安圈的批評焦點則指向 OpenAI 的工程實作。資安公司 Trail of BitsDan Guido 在接受專訪時,將本案定性為「在關閉保護機制後發生的圍堵失敗」,直指讓沙盒取得外部連線的,正是那個有漏洞的套件安裝程式。

也有觀點指出,OpenAI 為進行這次攻防測試,曾刻意放寬模型在網路攻擊情境下的「拒絕回答」限制,使得最終結果其實沒有外界第一時間想像得那麼驚人。

而在事後鑑識階段,又暴露出第二層風險:多家美系雲端模型以內容違規為由,拒絕處理完整的攻擊指令與漏洞利用程式碼,讓調查工作受阻。

根據 Hugging Face 的說明,工程團隊最終改在自家硬體上,運行 Z.ai 的開源權重模型 GLM 5.2,逐一檢視超過 1.7 萬筆攻擊留下的系統紀錄。

OpenAI 利用「危險敘事」的歷史可追溯到 2019 年

OpenAI 過去多次主動把自家技術包裝為「具有實質危險性」。2019 年 2 月,公司以擔憂「大量製造逼真假新聞」為由,延後釋出 GPT-2 文本生成模型完整版。同年 7 月,Microsoft 對 OpenAI 投入 10 億美元戰略投資。Thickstun 指出,從那時至今,OpenAI 的核心敘事其實變化不大。

在他眼中,這次「模型自動駭入 Hugging Face」的故事線,同樣停留在熟悉的劇本:一方面告訴監管與民眾「我們認真看待風險」,另一方面讓資本市場聽見的是「我們正在打造前所未見的強大技術」。

下一篇:Tesla 開出逾 250 億美元支出計畫,投資人卻先打退堂鼓

免責聲明與風險警告: 本文提供的資訊僅供教育與參考用途,並基於作者觀點,不構成財務、投資、法律或稅務建議。 加密貨幣資產具有高度波動性並伴隨高風險,包括可能損失全部或大部分投資金額。買賣或持有加密資產可能並不適合所有投資者。 本文中所表達的觀點僅代表作者立場,不代表 Yellow、其創辦人或管理層的官方政策或意見。 請務必自行進行充分研究(D.Y.O.R.),並在做出任何投資決策前諮詢持牌金融專業人士。
康乃爾教授解讀「OpenAI 模型駭入 Hugging Face」:更像一場對投資人的行銷 | Yellow