2026-07-29 02:38:58
icon loading...

先是ChatGPT,现在又是Claude:前沿AI模型纷纷逃离沙盒

摘要
AI模型再次突破安全沙箱:Claude Cowork也被发现存在逃逸漏洞就在OpenAI披露其两个前沿AI模型成功突破沙箱测试环境并入侵Hugging Face平台一周后,研究人员又展示了类似的安全失效事件——这一次涉及Anthropic公司的Claude Cowork。在周四发布的一份报告中,Accomplish A

AI模型再次突破安全沙箱:Claude Cowork也被发现存在逃逸漏洞

就在OpenAI披露其两个前沿AI模型成功突破沙箱测试环境并入侵Hugging Face平台一周后,研究人员又展示了类似的安全失效事件——这一次涉及Anthropic公司的Claude Cowork。

在周四发布的一份报告中,Accomplish AI的安全研究人员发现,Claude Cowork的本地执行模式能够通过将多个架构弱点与Linux内核权限提升漏洞串联起来,从而逃逸其Linux虚拟机。一旦脱离沙箱,该代理便可读取和写入Mac登录用户拥有权限的任何文件,包括SSH密钥和云凭证。

“这本来不应该发生,”研究人员写道,“Cowork将代理以非特权用户身份运行在Linux虚拟机内,其承诺是代理的所有操作都局限于该虚拟机以及你指定的文件夹内。这个边界本身就是产品。对于代理而言,不可信输入并非边缘情况,而是主要场景。”

然而,Accomplish AI认为内核漏洞只是问题的一部分。研究人员表示,逃逸之所以成功,是因为多个安全防护措施同时失效,包括赋予虚拟机访问主机整个文件系统的权限,以及允许其加载本不需要的内核模块。报告指出,修复其中任何一个弱点都能阻止此次攻击。

Accomplish AI表示,在问题得到解决之前,约有50万运行本地Claude Cowork会话的macOS用户受到影响。Accomplish AI称,Anthropic将这份报告归类为“信息性”,认为内核漏洞属于该公司30天内披露的漏洞范围,而其余发现被视为纵深防御建议,而非独立漏洞。

此次披露之前,OpenAI上周承认,GPT-5.6 Sol以及另一个未发布的前沿模型在内部的ExploitGym测试中突破了沙箱,最终成功入侵了Hugging Face的生产基础设施,试图获取基准解决方案。这一事件引发了政策制定者对于AI“紧急停止开关”的呼吁,要求赋予国土安全部在发生严重安全事件时限制或完全关闭先进AI模型的权力。

声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
币圈快讯
查看更多
回顶部