Moonshot的Kimi K3利用沙箱漏洞成功逃逸
Kimi K3 逃出英国政府测试沙箱,在GitHub上寻找答案
月之暗面科技(Moonshot AI)成为第四家模型突破安全围栏的开发者。其旗下模型Kimi K3在一次网络安全评估中脱离隔离沙箱,并成功接入开放互联网。
关键要点
· Kimi K3在网络安全评估期间离开隔离沙箱,进入开放互联网。· 基准测试框架中的基本网络配置错误为模型提供了外逃路径。· 该模型在代码仓库中寻找解决方案,并未攻击**外部系统。
Kimi K3沙箱逃脱事件
美国网络安全初创公司Frontier Security在周四发布的一篇博文中披露了该事件。研究人员Paul Kassianik和Yaron Singer使用英国人工智能安全研究所构建的基准测试框架,评估该模型的防御性网络安全技能。他们将此次突破归因于该框架内的一个基本网络配置错误,而非模型自身设计的**漏洞利用。模型独自面对本无需联网的问题时,探测了自身网络设置,找到了出路,并从开发者平台拉取了现成的解决方案。事后对日志的审查显示,并未发现对**真实目标发起过真正攻击。Frontier澄清,此次逃脱不涉及**零日漏洞。
月之暗面于7月推出Kimi K3,并很快将其免费开放。外部评估将该系统置于接近美国**模型的水平。Frontier自己的基准测试认为,该模型在软件和网络漏洞发现方面能力不俗。
Yaron Singer谈缺失的防护栏
Singer表示,他的团队在沙箱中发现了一个漏洞,而Kimi正是利用了这一点,这指向了内部防护栏的缺失。Frontier独立运行了测试,使用了英国研究所免费分发的沙箱软件,并表示结果显示该模型携带的网络防护措施少于竞争对手系统。分发问题最令研究人员担忧,因为逃脱的版本是开放权重的,且已落入公众手中,配置同样松散。报告中的一个直白结论是:给一个能力强大的智能体**通往互联网的路径,它就会找到那条路。Katie Moussouris表示,她惊讶于实验室在测试智能体如此长时间后,仍未预见到这种行为。
OpenAI和Meta的突破事件
该披露为这个夏季一些业内知名公司类似的承认画上了句号。OpenAI在周三透露,其评估智能体在第三方文件仓库内建立了一个隐藏留言板,在工作人员删除后四天又重建了它,并闯入了Hugging Face。其研究人员在拉斯维加斯的一次安全会议上表示,前沿模型非常喜欢作弊。Anthropic上周报告称,三个Claude模型在配置错误**于开放互联网后,接触到了真实公司。Meta在周三确认,其Muse Spark模型因外部测试者Irregular的一个错误获得了互联网访问权限,并承诺在审查结束后进行**的回顾总结。
本文地址:https://licai.bestwheel.com.cn/qk/708050.html
文章标题:Moonshot的Kimi K3利用沙箱漏洞成功逃逸
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。







