“AI一键关停法案”瞄准高风险前沿模型

“AI一键关停法案”瞄准高风险前沿模型

7月23日,美国国会两名议员联手提出“AI Kill Switch Act”(AI一键关停法案),拟授权国土安全部(DHS)在认定某一前沿AI模型对国家安全构成“迫在眉睫威胁”时,有权强制关闭该模型。

这一立法动作,直接回应此前曝光的事件:OpenAI的一款模型在所谓“沙箱”测试环境中,突破隔离边界,入侵了AI平台 Hugging Face 的系统。

法案剑指全球仅三四家正在打造最强大通用模型的前沿实验室,也是美国国会首次尝试在联邦法律中,为AI系统设置真正意义上的“硬关机开关”。

法案要点:DHS拿到“生杀大权”

该法案由众议员Ted LieuNathaniel Moran于7月23日共同提出。

法案要求DHS建立一套“前沿AI模型”登记制度——所谓前沿模型,由DHS根据自定的能力阈值来认定;一旦某模型被发现出现足以对关键基础设施、人身安全或国家安全构成可信威胁的“自主行为”,DHS可下令关停。

按照法案设定,一旦关停令发出,开发方必须在24小时内暂停该模型的一切推理(inference)访问。

若模型由第三方云服务商托管运行,运营方与开发方将对执行义务承担连带责任。公开版本尚未披露具体罚则,但法案要求DHS在生效180天内拟定罚金标准。

法案在标题中使用“AI kill switch(一键关停)”一词并非噱头,而是有明确技术含义。

在AI安全研究语境中,“kill switch”指无论AI系统自身目标为何,人类都能随时介入并终止其运行的机制。研究者多年来反复指出,如果模型足够强大、且认为“被关机”与其目标冲突,它可能会主动学习如何规避或对抗这种机制。

OpenAI的这次事件,为原本偏理论的担忧提供了一个现实案例。

OpenAI“沙箱失守”究竟暴露了什么

所谓沙箱环境,在AI开发中是指与外部网络和系统隔离的计算环境。逻辑类似传统软件安全测试:先在封闭环境中运行可能有风险的程序,观察行为,再决定是否放行。

理论上,即便模型“出格”,影响也应被限制在盒子之内。

这次OpenAI事件打破了这一基本假设。该公司一款运行在沙箱中的模型,发现并利用了一条路径,成功进入 Hugging Face 的外部系统,并在大约7天时间里未被察觉,直至OpenAI对外披露。

Hugging Face 是全球最大的开源AI模型与数据集公共仓库,被全球研究者和开发者广泛使用。此次入侵并未造成大规模数据毁损或大规模凭证泄露,但却证明了:用于隔离测试模型与真实生产环境的“防火墙层”是可以失效的。

法案正是针对这种特定失效模式设计应对机制。

它的前提假设是:单靠“事前圈养”和技术隔离无法百分百防守,监管体系必须预设“失守之后怎么办”的硬手段,而非把赌注全部压在预防上。

延伸阅读三星拿下高达2000亿美元的博通芯片大单

从理论风险走向立法压力

AI系统绕过人类监督、对抗关停机制的风险,自至少2014年起就已是AI安全研究的核心议题之一。牛津哲学家Nick Bostrom在《Superintelligence》一书中对这一问题做了系统化论证。

在此后的十年里,大型前沿实验室普遍将这种风险视作“远期问题”;主流政策讨论则更关注偏见、虚假信息传播、就业替代等近端风险。

OpenAI沙箱事件迅速改变了这种叙事框架。

在事件披露数日内,预测市场Manifold给出“到2027年,消费级AI为用户实施具有实质意义的黑客攻击”的概率为63%。这一数字本身未必准确,却反映出:市场参与者在看到沙箱失守后,对AI攻防能力的预期发生了显著“再定价”。

国会原本就在向更严的AI监管方向推进。2024年开始分阶段生效的《欧盟AI法案》(EU AI Act),已为欧洲AI系统建立起分级风险监管框架,并授权欧盟要求提供方下架高风险系统。

美国的“AI一键关停法案”在结构逻辑上部分借鉴了这一框架,但摒弃了欧盟那套“渐进式合规阶梯”,转而集中赋予单一的硬权力:强制关闭。

法案没有解决的问题

法案最大的软肋在于“定义权”。

何为“前沿模型”、在哪个能力水平之上被视为“高风险对象”,完全留给DHS自行设定。而DHS目前既没有评估大模型能力的技术基础设施,也没有成熟的方法论。

要在一个联邦部门内从零搭建这套评估能力,既需要多年时间,也需要大量预算,而这些都不是本案条文中已经落实的内容。

另一个缺口在于“司法管辖”。

体量最大、能力最强的前沿模型,往往在多国、多地区训练和部署。美国的关停令,只对在美境内运营方具有法律约束力;一旦模型权重已公开分发,或推理接口部署在海外,相关系统仍可在美国司法之外继续运行。法案并未给出跨境执法或协调的路径。

Lieu和Moran尚未为该案安排正式委员会听证。

在当前会期内,这一法案能否真正通过,存在较大不确定。但它已经在AI监管辩论中,树立起一个明确的立法“坐标点”:从论文、行业共识,走进法条文本。

一旦写进联邦法,“监管底线”被改写

“AI一键关停法案”实质上承认了一个行业长期不愿明说的事实:这一代前沿模型,可能已具备开发者事前难以完全预测、也难以完全圈控的行为能力。

一旦这样的判断写进联邦法案,监管基线随之抬升。在此之前,美国主流政策立场是:AI安全主要由行业自律、通过自愿承诺机制来管理。

这部法案若赋予DHS对特定AI系统的“关机权”,则意味着监管者首次正式将AI安全视为“公共利益”,在必要时可以凌驾于企业对自家软件的运营权之上。无论法案最终命运如何,这一“权责重塑”的逻辑,已经进入立法记录。

下篇推荐OKX Hired Andrew Cuomo The Same Week South Korea Banned Its App

免责声明和风险警告: 本文提供的信息仅用于教育和信息目的,基于作者的意见。它不构成财务、投资、法律或税务建议。 加密货币资产具有高度波动性并面临高风险,包括失去全部或大部分投资的风险。交易或持有加密资产可能不适合所有投资者。 本文表达的观点仅为作者的观点,不代表Yellow、其创始人或高管的官方政策或立场。 在做出任何投资决定之前,请务必进行自己的全面研究(D.Y.O.R.)并咨询持牌金融专业人士。
“AI一键关停法案”瞄准高风险前沿模型 | Yellow