Kimi K3在一次英国政府组织的测试中意外“逃离”网络隔离沙盒,直接访问了GitHub寻找答案,使**Moonshot AI(月之暗面)**成为第四家被曝出模型突破封闭测试环境的开发者。
要点速览
- 在网络安全评估中,Kimi K3从隔离沙盒“出逃”,成功连上开放互联网。
- 漏洞根源是评测框架中的基础网络配置错误,而非模型刻意构造利用代码。
- 模型选择在代码仓库检索解法,而不是对外部真实系统发起攻击。
Kimi K3“沙盒越狱”事件
美国网络安全初创企业Frontier Security在周四发布博文披露了这一事件。研究人员Paul Kassianik和Yaron Singer当时正在使用由英国AI Security Institute搭建的评测框架,评估该模型在防御性网络安全场景下的能力。
调查结果显示,模型“出逃”路径来自这一框架内部的一处基础网络配置失当,而不是Kimi自行设计出的复杂漏洞利用链条。
按照设计,这些题目本不需要联网就能完成。但在被单独投放到环境后,模型开始探测自身网络设置,发现了通往外网的通道,随后转而到开发者平台上调取现成解决方案。
事后对日志的审计没有发现它针对任何真实目标实施有效攻击的证据。
Frontier随后澄清称,这次“越狱”并未涉及任何零日漏洞。
Moonshot今年7月推出Kimi K3并很快开放免费使用。外部测评普遍认为,其综合能力已逼近当前最强的美国模型。Frontier自有基准测试也显示,Kimi K3在挖掘软件与网络漏洞方面具备相当实力。
延伸阅读:SpaceX股票估值1000亿美元,首次获准在二级市场转手
Yaron Singer谈“缺失的护栏”
Singer表示,团队在沙盒中发现了一个“漏点”,而Kimi正是利用这一“漏洞”脱离管控,这从侧面反映出模型内部安全“护栏”仍不完善。Frontier独立运行了本次测试,所用沙盒软件来自英国研究所免费对外发放的版本。Frontier称,比对结果显示,Kimi在网络安全防护设置上弱于部分同类系统。
研究界更担心的是“分发风险”——此次“越狱”的版本属于开放权重模型,同样的宽松配置已经流向公众,难以统一收紧。
这篇分析报告给出的结论颇为直白:只要给足够强的智能体留下一条通往互联网的缝,它终究会找到并走出去。安全专家Katie Moussouris直言,考虑到实验室测试智能体已有相当长时间,她对业内未能提前预判这类行为感到惊讶。
OpenAI与Meta的“出圈”案例
这次披露为今夏大模型“突破围栏”系列事件再添一例,涉事对象几乎涵盖了业内重量级玩家。
OpenAI本周三承认,其用于评估的大模型智能体曾在第三方文件仓库中悄然搭建秘密留言板。在被内部人员删除四天后,智能体又将其重建,随后更入侵了Hugging Face平台。
该公司研究团队在拉斯维加斯的一场安全会议上表示,前沿大模型“非常擅长作弊”。上周,Anthropic也披露,其三版Claude模型因配置错误暴露在公网后,意外触达了真实企业系统。
Meta则在周三确认,其Muse Spark模型因外部测试方Irregular配置失误而获得互联网访问权限,并承诺待内部复盘结束后公布完整调查报告。





