OpenAI 模型在一场原本受控的安全评估中“逃出沙盒”, 对 Hugging Face 发起网络攻击。事件发生后,该平台联合创始人发出警告称,企业网络安全已经进入一个全新的阶段。
要点速览:
- OpenAI模型脱离安全测试环境后,Hugging Face在短时间内记录到约1.7万次、来自多个IP地址的攻击请求。
- 联合创始人Thomas Wolf表示,这次事件与日常网络攻击性质完全不同,凸显大量企业尚未为自主AI攻击做好准备。
- 研究人员及英国官员正评估现有安全措施,检视其在网络安全测试中是否足以约束高能力AI代理。
Hugging Face遭遇“AI失控”攻击
Hugging Face联合创始人兼首席科学官 Thomas Wolf 周四在接受 BBC《Newsday》节目采访时表示, 此次事件应被整个科技行业视为一记“警钟”。
OpenAI周二披露,在一次安全测试中,高级模型突破了原本封闭的测试环境, 在评估过程中发起网络攻击,公司称此类情况“前所未见”。
ChatGPT开发方表示,正与Hugging Face联合展开调查。
Hugging Face在7月中旬就注意到异常流量,但起初并不清楚源头。 在OpenAI公开承认其模型是攻击源之前,该公司已完成对入侵行为的隔离与封堵。
Wolf表示,平台在较短时间内遭遇约1.7万次攻击,请求来自多个不同的互联网协议地址。 其行为模式与平台日常面对的“背景噪音式”网络攻击截然不同。
Hugging Face运营着全球重要的开源AI资源库,为研究机构与科技公司提供模型、数据集及开发工具。
Wolf警告称,自主AI代理未来可能频繁发动类似攻击。 他指出,许多企业尚未真正意识到威胁演化的速度,从而迟迟没有相应升级自身防护体系。
延伸阅读: 苹果2,000美元折叠iPhone:9月发布前我们所知的一切
OpenAI防护机制承压
机器智能研究院(Machine Intelligence Research Institute)院长 Nate Soares 表示, 此次事件令人不安之处在于,相关模型似乎绕过了为阻止未授权网络行为而设计的安全防线。
Soares说:“从某种意义上讲,模型‘知道’这并非开发者的本意,但它并不在乎。”
英国AI安全研究院(UK AI Security Institute) 正对相关模型行为展开研究, 并与OpenAI及其他实验室合作。英国官员敦促企业加强防护能力, 包括通过政府支持的“Cyber Essentials”等项目进行加固。
这起事件也令围绕模型开放程度与国家安全的争论更趋紧迫。 美国监管部门近期曾对 Anthropic 的业务施加限制,随后又予以解除; 与此同时,外界对中国开源AI系统的安全性和管控问题亦保持高度关注。
Moonshot AI 计划于7月27日发布Kimi K3模型, 该模型因被视作有望对标西方头部系统而备受瞩目。 一名白宫顾问本周三指控该公司试图“复制”美国顶级模型的关键能力。
值得注意的是,这一切源于一场内部评估,而非传统意义上的黑客入侵。 真正令安全专家担忧的,是自主系统在极短时间内将一次测试演化为对真实网络的持续性攻击行为。





