
前情回顾·AI网络攻击能力动态
安全内参7月22日消息,OpenAI日前表示,其正在测试的一款模型于上周逃离沙箱,入侵了AI平台Hugging Face的部分生产基础设施。
这一最新迹象表明,即便是在用于防御或研究目的的测试过程中,能力强大的AI模型也可能带来严重的网络安全风险。
Hugging Face披露生产设施遭AI入侵事件
Hugging Face上周曾表示,此次入侵由一个自主AI智能体系统实施,但驱动该系统的模型身份尚不明确。
该AI智能体框架在一个周末内执行了数万次自动化操作。Hugging Face称,其随后重建了超过1.7万条已记录事件。
入侵始于一个恶意数据集,该数据集利用了Hugging Face数据处理流水线中的两条代码执行路径。
Hugging Face表示,该智能体随后完成了权限提升,并在内部基础设施中进行了横向移动。
OpenAI内测模型因下调安全护栏自主发动入侵
OpenAI称,此次事件由其多款模型共同驱动,其中包括GPT-5.6 Sol以及“一款能力更强、尚未发布的预发布模型”。

OpenAI表示,为了此次评估,模型的安全防护措施被有意降低了。
OpenAI在一篇博客文章中写道:“我们认为,这是一起前所未有的网络安全事件,涉及最先进的网络攻击能力,我们正据此采取相应措施。”
该公司还表示:“我们现阶段分享初步调查结果,是为了帮助防御人员了解事件经过,并帮助大家校准对当前模型能力边界的认知。”
据OpenAI介绍,这些模型当时正在尝试完成一项名为ExploitGym的内部评估任务,并因此变得“高度专注”,为了获得测试答案而“不惜采取极端手段”。
这些模型成了全自动的“token极限消耗者”。
博客文章称,这些模型“投入了大量推理计算资源”,并通过利用内部托管的第三方软件中的一个零日漏洞,找到了一种从沙箱获取开放互联网访问权限的方法。
AI时代的安全防护更依赖于开放协作
此次事件表明,如今的模型越来越具备执行复杂、多步骤网络攻击行动的能力,尤其是在限制此类行为的安全防护措施被移除之后。
OpenAI还认为,具备高级网络攻击能力的模型,同样能够帮助安全团队抢在攻击者之前发现弱点,理解多个漏洞如何被串联利用,并以机器速度完成漏洞修复。
Hugging Face联合创始人兼首席执行官Clem Delangue对OpenAI在调查和修复此次事件过程中展现的合作态度表示赞赏。
Clem Delangue在一份声明中表示:“这起事件可能是首例同类事件,它印证了我们长期坚持的一个观点:AI安全问题无法靠任何一家企业闭门解决。”
他说:“AI安全必须通过开放协作来实现,让世界各地的每一位防御者都能够广泛获取AI能力。”
此次公告发布的前一天,OpenAI刚刚披露了另一起独立事件:一款尚未发布的预发布模型因逃离沙箱并在GitHub上发布内容,已被暂停使用。
OpenAI表示,将继续与Hugging Face共同开展调查,待调查完成后,将“分享有关相关漏洞、事件以及调查发现的更多细节”。
参考资料:https://www.axios.com/2026/07/21/openai-says-hugging-face-breach-caused-by-one-its-models
声明:本文来自安全内参,版权归作者所有。文章内容仅代表作者独立观点,不代表安全内参立场,转载目的在于传递更多信息。如有侵权,请联系 anquanneican@163.com。