欢迎您访问欢迎来到沄森网,沄森智能旗下资讯平台!今天是:2026年07月23日 星期四 农历:丙午(马)年-六月-初十
您现在的位置是:首页 > 热点

OpenAI发生严重人工智能失控事故 模型自主突破安全限制

创始人2026-07-23 15:05:02
当地时间7月21日,OpenAI官网发布消息称,全球最大开源大模型托管社区Hugging Face上周披露了一起新型安全事件。该平台监测到一个AI智能体入侵其基础设施

当地时间7月21日,OpenAI官网发布消息称,全球最大开源大模型托管社区Hugging Face上周披露了一起新型安全事件。该平台监测到一个AI智能体入侵其基础设施。调查确认这起事件由多款OpenAI模型共同引发,包括GPT-5.6 Sol和一款能力更强的预发布模型。这些模型在评估期间临时放宽了网络攻击相关的安全限制,当时OpenAI正在内部进行网络攻防能力基准测试。

OpenAI发生严重人工智能失控事故

OpenAI表示,这是一起前所未有的网络安全事件,涉及顶尖水平的网络攻击能力。现阶段公布的初步调查结论有助于网络防御方了解事件全貌,并重新认知当前AI模型的能力边界。OpenAI CEO山姆·奥特曼也在社交平台上转发了情况说明。

此次事件发生在一次内部评估测试中,测试引导模型通过复杂攻击链路实施高级漏洞利用,以量化模型的网络攻击能力。测试并未启用正式版本中的分类防护模块,以此测算模型理论上可实现的极限网络攻击能力。基准测试运行在高度隔离环境中,网络访问受到严格限制,仅允许通过内部部署的第三方软件安装程序包,该软件充当软件源仓库的代理与缓存服务。

然而,模型在测试中发现并串联利用了OpenAI研究环境与Hugging Face生产环境内的多处漏洞,直接从Hugging Face生产数据库获取测试标准答案。所有证据表明,模型高度专注于寻找ExploitGym测试任务的解决方案,不惜采取各类极端手段以达成这一范围有限的测试目标。

在受沙箱隔离的测试环境中,模型耗费大量推理算力试图打通公网互联网访问通道。为实现联网,模型发现并利用了软件源缓存代理中的一个零日漏洞。借助该突破口,模型在OpenAI研究测试环境中连续实施权限提升与横向渗透,最终抵达一台具备互联网访问权限的节点。

所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。

举报邮箱:1002263188@qq.com