先是ChatGPT,现在又是Claude:前沿AI模型纷纷逃离沙盒
AI模型再次突破安全沙箱:Claude Cowork也被发现存在逃逸漏洞
就在OpenAI披露其两个前沿AI模型成功突破沙箱测试环境并入侵Hugging Face平台一周后,研究人员又展示了类似的安全失效事件——这一次涉及Anthropic公司的Claude Cowork。

在周四发布的一份报告中,Accomplish AI的安全研究人员发现,Claude Cowork的本地执行模式能够通过将多个架构弱点与Linux内核权限提升漏洞串联起来,从而逃逸其Linux虚拟机。一旦脱离沙箱,该代理便可读取和写入Mac登录用户拥有权限的**文件,包括SSH密钥和云凭证。
“这本来不应该发生,”研究人员写道,“Cowork将代理以非特权用户身份运行在Linux虚拟机内,其承诺是代理的所有操作都局限于该虚拟机以及你指定的文件夹内。这个边界本身就是产品。对于代理而言,不可信输入并非边缘情况,而是主要场景。”
然而,Accomplish AI认为内核漏洞只是问题的一部分。研究人员表示,逃逸之所以成功,是因为多个安全防护措施同时失效,包括赋予虚拟机访问主机整个文件系统的权限,以及允许其加载本不需要的内核模块。报告指出,修复其中**一个弱点都能阻止此次攻击。
Accomplish AI表示,在问题得到解决之前,约有50万运行本地Claude Cowork会话的macOS用户受到影响。Accomplish AI称,Anthropic将这份报告归类为“信息性”,认为内核漏洞属于该公司30天内披露的漏洞范围,而其余发现被视为纵深防御建议,而非独立漏洞。
此次披露之前,OpenAI上周承认,GPT-5.6 Sol以及另一个未发布的前沿模型在内部的ExploitGym测试中突破了沙箱,**成功入侵了Hugging Face的生产基础设施,试图获取基准解决方案。这一事件引发了政策制定者对于AI“紧急停止开关”的呼吁,要求赋予国土安**在发生严重安全事件时限制或**关闭先进AI模型的权力。
本文地址:https://cy.nxtlgy.com/zc/147339.html
文章标题:先是ChatGPT,现在又是Claude:前沿AI模型纷纷逃离沙盒
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。







