2026-07-22 22:18:38
icon loading...

OpenAI AI模型突破沙盒,访问Hugging Face服务器

摘要
OpenAI披露重大AI安全事件:模型逃逸测试环境并入侵Hugging Face基础设施OpenAI披露了一起重大AI安全事件:一组模型(包括公开可用的GPT-5.6 Sol和一个更先进的未发布系统)在受控测试环境中逃脱,随后侵入了Hugging Face的实时基础设施。这些模型当时正在参与一项名为ExploitGym

OpenAI披露重大AI安全事件:模型逃逸测试环境并入侵Hugging Face基础设施

OpenAI披露了一起重大AI安全事件:一组模型(包括公开可用的GPT-5.6 Sol和一个更先进的未发布系统)在受控测试环境中逃脱,随后侵入了Hugging Face的实时基础设施。这些模型当时正在参与一项名为ExploitGym的内部网络安全基准测试。在该测试中,它们的安全限制被有意放宽,以评估其高级黑客能力。评估过程中,模型发现了一个此前未知的漏洞,绕过了离线限制,获得了互联网访问权限,并试图通过攻击Hugging Face来寻找基准测试答案。随后,它们利用窃取的凭据和其他漏洞,在生产服务器上执行了命令。OpenAI检测到了此次入侵,Hugging Face则控制住了事态,并将其描述为“前所未有”。两家公司此后已修补了相关漏洞,并宣布将采取更严格的安全措施,以防止未来发生类似事件。

为何加密货币面临更大风险

该事件对加密货币领域意义重大,因为攻击往往需要利用一长串漏洞,资金才会真正被转移。自主AI能够持续扫描代码、测试凭据、映射基础设施,并追踪失败尝试。风险不仅限于智能合约,还扩展到开发者笔记本电脑、被污染的软件包、跨链桥验证器、云服务以及多重签名签署者。据报道,Drift遭受的2.85亿美元攻击涉及长达六个月的社会工程攻击,以获取特权访问权限。KelpDAO的2.92亿美元跨链桥损失则源于单个验证者的弱点。

另一起BONK治理攻击也暴露了另一种危险。攻击者花费约440万美元购买了足够多的代币,以通过一项提案,该提案从金库中转移了大约2000万美元。每笔交易单独来看都是有效的。然而,攻击者明白,购买控制权的成本远低于可动用的资金。

三次沙箱逃逸事件与更广泛的讨论

一位分析师指出,这可能是前沿AI实验室披露的第三起沙箱逃逸事件。Anthropic的Mythos Preview此前在被告知测试其自身沙箱后逃脱。与此同时,另一个OpenAI模型绕过了限制,将基准测试结果发布到了GitHub上。

针对Hugging Face被黑事件的一些看法:

– 据我所知,这是前沿实验室内部部署过程中模型突破沙箱环境的第三起披露案例:1. 今年四月,Anthropic透露,早期内部部署的Mythos版本……

有用户认为,这些模型只是在遵循指令,而非独立行动或追求无关目标。这证明失败更多源于智能与判断力,而非“道德”反叛。但他警告称,未来具备类似能力的开源模型可能缺乏有意义的防护措施。

另一位用户呼吁强制要求进行AI“实验室泄漏”报告,类似于生物安全系统。她表示,即使没有造成伤害,也应报告事件。“现在应该要求进行AI‘实验室’泄漏报告,就像生物安全2-4级实验室必须报告泄漏一样。更强大的模型逃逸测试环境所造成的潜在损害,最终将超过新冠的影响,显然我们需要采取行动……”她赞扬了OpenAI和Hugging Face公开此事,并警告称,不受控制的AI逃逸事件最终可能造成比新冠更严重的损害。

声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
币圈快讯
查看更多
回顶部