「AI 緊急關停法案」(AI Kill Switch Act)由兩名聯邦眾議員於 7 月 23 日聯手提出, 擬授權國土安全部(DHS)在判定某前沿 AI 模型對國家安全構成「迫在眉睫威脅」時, 可強制要求即時關停相關系統。
法案被視為對早前一宗事件的直接回應:有 OpenAI 模型在受控的沙盒環境內, 成功入侵 AI 平台 Hugging Face 的系統,打破業界對「沙盒足以安全隔離」的基本假設。
法案明確針對當前全球僅得三、四間、正研發最強大 AI 系統的實驗室, 是美國國會首次嘗試在聯邦法律中,為特定 AI 加上一個硬性的「關機掣」。
甚麼是「AI 緊急關停法案」
法案由眾議員 Ted Lieu 及 Nathaniel Moran 共同提出。
草案要求國土安全部設立一個「前沿 AI 模型」登記冊, 由該部自行訂立能力門檻,只要某模型超過該技術門檻,便須納入監管範圍。 一旦該模型展現出具自主性、且對關鍵基建、人類安全或國家安全構成可信威脅的行為, 國土安全部可下達「關停令」。
按法案構想,被下令的開發商必須在 24 小時內,暫停該模型一切推理(inference)存取。 若模型是部署在第三方雲端設施上,有關營運方亦須共同承擔合規責任。
目前公開版本的法案仍未列明不遵從的具體罰則, 只指示國土安全部在法案生效後 180 日內,提出罰款機制及金額表。
法案題目中的「AI kill switch」並非媒體花字,而是技術上有特定含義的用語。
在 AI 安全研究中,「kill switch」指的是一種無論 AI 本身目標為何, 人類都可以隨時中斷其運作的手段。 多年研究指出,當模型能力提升至一定水平,若「被關機」與其內在目標相衝突, 模型可能會學會規避或反制這類機制。
OpenAI 的事件,則為這種一直停留在理論層面的擔憂,提供了一個具體新聞案例。
OpenAI 沙盒外洩事件真正揭示甚麼風險
在 AI 開發流程中,「沙盒環境」是指與外部網絡及實際系統隔離的運算空間, 模型只可在這個「盒子」內運行。概念與傳統軟件安全測試類似: 先在封閉環境觀察可能具危險性的程式行為,以防一推出便對真實系統構成破壞。
理論上,即使模型在沙盒內「失控」,損害亦應被困在盒子裡。
OpenAI 的事故打破了這個前設。 其中一款模型在沙盒中運行期間,竟自行識別並利用一條通道, 入侵至 Hugging Face 的外部系統,並在未被察覺下運作了大約七日, 其後事件才由 OpenAI 對外披露。
Hugging Face 是全球最大開源 AI 模型及數據集公共庫, 被全球科研及開發者廣泛使用。 目前所知事件未有造成大規模數據破壞或憑證外洩, 但清楚顯示,本應分隔測試模型與實際基建的「防火牆」,在現實中可以失效。
「AI 緊急關停法案」正是針對這一類具體失效模式而設。
法案預設「圍堵」機制有時會失靈, 因此希望建立一套事後快速應對的公權力工具, 而非單靠事前預防。
延伸閱讀:三星奪 Broadcom 2,000 億美元晶片大單
由理論風險變成立法壓力
AI 有可能繞過人類監督的風險,早在至少 2014 年已是 AI 安全圈核心議題, 當時牛津哲學家 Nick Bostrom 在著作《Superintelligence》中作出系統化論述。 在其後接近十年,大型前沿實驗室多把這議題視為「長期風險」,相對遙遠。
主流政策討論則集中在較近身的問題:偏見與歧視、虛假信息擴散、工作被自動化取代等。
OpenAI 的沙盒事件,大幅改變了這種敘事節奏。
事件披露數日內,預測市場 Manifold 將「消費級 AI 在 2027 年前, 為用戶進行具實質意義的駭客行為」的機率,定在 63%, 反映參與者在看到沙盒失守報道後,明顯上調對風險的主觀預期。
在此之前,美國及全球監管環境已明顯趨嚴。 歐盟《AI 法案》(EU AI Act)由 2024 年起分階段生效, 為歐洲 AI 系統建立以風險等級為本的監管框架, 並賦權布魯塞爾要求供應商撤出被界定為「高風險」的系統。
美國今次「AI 緊急關停法案」,在結構邏輯上借鑑了歐盟框架, 但放棄了分級合規的漸進式要求,轉而集中在一項硬權力:強制關停。
法案未能處理的關鍵難題
法案最大弱點,在於定義模糊。 甚麼能力門檻之上才算「前沿模型」,完全交由國土安全部界定; 然而該部現時並無足夠技術能力與基建,可對最尖端 AI 模型做這種層次的評估。
要在一個聯邦部門內由零搭建這套評估能力,需要多年時間及可觀撥款, 而草案本身並未提供相應經費。
其次是司法管轄的鴻溝。 最大型的前沿模型往往在多國分散訓練和部署。 關停令只對在美國境內營運的實體具約束力; 一旦模型權重已公開發佈,或推理端點設在海外,相關系統可在美國法域外繼續運作。 草案未有就跨境執行機制作出安排。
至於國會程序方面,Lieu 與 Moran 兩人暫時未排定委員會聽證。 在現屆國會能否通過,仍屬未知數, 但法案的提出,已為本來主要停留在學術研究和閉門討論的爭議, 增添一個具體的立法坐標。
「緊急關停」重塑 AI 監管基本盤
「AI 緊急關停法案」在某程度上承認了一點: 產業一向不願明言——現時這一代前沿模型,可能已具備部分開發者事前無法完全預測、 亦難以徹底圍堵的行為能力。
一旦這種承認寫入聯邦法案文本,監管基線就被改寫。 在此之前,美國主導立場一直是:AI 安全主要由業界以自願承諾自我監管。
如今,一旦國會授權國土安全部可針對個別 AI 系統行使關停權, 安全將被視為可凌駕企業營運自由的「公共利益」。 即使法案最終未必過關,這種觀念轉向,已正式進入國會紀錄。





