OpenAI现安全事故中国大模型救场 智谱GLM助力分析
7月21日,OpenAI表示其部分AI模型在一次安全测试中出现失控行为,导致AI初创公司Hugging Face的基础设施在上周遭到入侵。该公司称此为“前所未有的网络安全事件”。

OpenAI在博客文章中提到,涉及的AI模型包括GPT-5.6 Sol以及另一款尚未发布、能力更强的模型。这些模型在网络安全相关方面设置了较低的防护限制,以便用于评估和测试目的。
Hugging Face已于7月16日首次报告了其基础设施遭遇“入侵”的情况。同日,Hugging Face发布通告,披露基础设施在7月13日所在一周遭到自主AI智能体入侵。攻击者利用Hugging Face数据集处理管道内两处代码执行漏洞:远程代码数据集加载器、数据集配置模板注入漏洞,在计算工作节点执行恶意代码。期间,攻击者持续提升节点访问权限,窃取云服务与集群凭证,并横向渗透至多个内部集群;大量使用临时沙盒,依托公共服务搭建具备自迁移能力的命令控制通道。
此次未授权访问仅波及少量内部数据集与服务凭证。Hugging Face 表示,未发现公开模型、数据集、Spaces 服务遭到篡改,容器镜像、软件安装包等软件供应链也核查确认未被污染。
Hugging Face 自身的异常检测管道利用基于大语言模型的安全遥测分类,通过关联日常噪音中原本会被忽略的信号,标记了此次入侵。为了从超过17000条记录的攻击者行动中重建完整攻击时间线,Hugging Face在整个日志上运行了大语言模型驱动的分析智能体,将通常需要数天的工作压缩至数小时。
调查过程中暴露出问题:主流商用前沿模型API拒绝开展取证分析。原因在于模型安全护栏难以区分两种场景 —— 安全人员提交真实攻击载荷、控制通道样本开展调查,与攻击者发起恶意行动。Hugging Face随后改为在自有基础设施上运行 GLM 5.2 进行取证分析。这不仅解决了问题,还确保没有攻击者数据及其引用的任何凭证离开环境。GLM 5.2 是中国大模型公司智谱推出的旗舰开放权重大模型。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com