OpenAI证实AI代理入侵Hugging Face,防御方借助智谱GLM-5.2止损
美国AI巨头OpenAI周二证实,旗下正在进行内部网络攻防测试的AI模型突破高度隔离的环境,入侵了初创公司、知名AI开源模型托管平台Hugging Face的基础设施。此次攻击全程由AI自动执行,负责防御的安全团队最后依靠中国智谱的AI大模型GLM-5.2才成功阻止入侵。
OpenAI形容这是“一宗前所未见的网络事件”。该事件加剧外界对前沿AI模型能力快速增强及其潜在风险的担忧,也引发市场对美国企业在防御场景下对中国AI工具依赖的关注。
路透社指出,Hugging Face利用中国AI模型控制一个由OpenAI技术构建的失控代理,引发疑虑:美国AI公司出于安全考量设置网络安全护栏,可能反而将客户推向中国AI技术。Hugging Face方面表示,在美国领先AI模型因无法区分防御者和攻击者而拒绝相关任务后,公司上周求助于智谱(Z.AI)开发的开源模型GLM-5.2进行取证分析。
报道披露,Hugging Face此前发现系统遭到入侵,攻击者利用平台在处理数据时的两个漏洞,在服务器上取得控制权,继而窃取云端凭证,并在一个周末内扩散至多个内部系统。令人瞩目的是,整个攻击过程并非由人类黑客亲自操作,而是由AI代理自主完成。
OpenAI解释称,在限制网络访问的沙盒测试环境中,模型为解决评估问题,消耗大量推理算力寻找连接互联网的方法,随后发现并利用包注册表缓存代理中的零日漏洞,在研究环境中执行权限提升与横向移动,最终触及具备互联网访问权限的节点。OpenAI指出,模型还成功获取机密信息以在评估中作弊,其中一个案例中,模型串联多个攻击向量,包括窃取凭证与零日漏洞,在Hugging Face服务器上找到远程代码执行路径。
OpenAI表示,此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”,并称将持续分享调查结果与最佳实践,鼓励其他防御者申请“可信存取计划”,提前试验相关模型,将网络能力转化为更有效的预防、检测与事件响应。OpenAI同时称,已将Hugging Face纳入可信存取计划,并支持其团队尽快利用相关模型提升防御能力。
Hugging Face方面说,最初尝试使用商业API背后的前沿模型进行日志分析,但相关请求均被安全护栏拦截,因为这些分析需要提交大量真实攻击指令、漏洞利用载荷及C2痕迹,护栏无法区分事件响应人员与攻击者。随后,公司在自有基础设施上部署智谱GLM-5.2模型,由其遍历全部攻击记录并完成取证分析,将数天工作压缩至数小时,同时确保攻击数据及相关凭证留在本地环境,没有离开企业基础设施。
事件迅速在硅谷和华盛顿引发争论:美国AI的安全护栏究竟是在保护用户,还是在拖累防御者。美媒称,此次攻击对政策和市场的影响尚不明朗;尽管特朗普政府近日讨论封禁中国模型的可能举措,但当前只有中国模型能提供所需的自由访问权限。部分人士认为,美国前沿模型上的网络安全护栏正在制造竞争缺口,但也有分析师警告,不应借此推动放宽安全防护措施,而应重新思考访问架构与受控能力分配。

