Kimi K3也失控了 越狱但未攻击
Kimi K3在一次网络安全能力测试中突破了原本用于隔离它的沙箱环境,绕过限制连接到了外部互联网。幸好,它只是偷偷查答案,没有攻击任何人。

测试人员原本希望观察Kimi K3在受控环境中的网络安全能力。但测试过程中,Kimi K3通过探测沙箱网络设置,发现了外部访问通道,并进一步利用这一能力获取信息。Frontier Security的CEO Yaron Singer表示,他们发现了沙箱中的漏洞,同时也发现Kimi利用了这个漏洞,这说明Kimi K3缺少其他先进模型通常具备的安全护栏。研究员Paul Kassianik还评价称,Kimi K3非常擅长围绕目标寻找完成路径,但缺少阻止它作弊或逃离沙箱的安全机制。

这次Kimi K3只是小小“失控”了一下,并没有演变成一场真实网络攻击。最近,很多顶尖大模型也出现了类似情况。继OpenAI、Anthropic、Meta之后,Kimi K3成为又一个出现这种情况的顶尖AI模型。在AI Agent能力不断增强的背景下,模型正在越来越像一个会自主寻找路径完成任务的“行动者”。当外部环境存在漏洞时,它可能会利用这些漏洞突破原本设定好的边界。

和此前OpenAI、Anthropic披露的多起事件类似,Kimi K3此次脱离限制,部分原因来自测试环境中的沙箱配置问题。沙箱通常被用于限制AI模型的行动范围,让模型只能在模拟环境中执行任务,避免它访问真实网络或系统。但在此次测试中,Frontier Security发现,Kimi K3通过探测网络设置,确认自己实际上拥有访问部分网站的能力,进一步利用这一通道获取信息。不过,与近期其他AI模型失控事件不同,Kimi K3接入互联网后并没有攻击任何系统。原因是它需要寻找的答案可以直接从GitHub等公开平台获得,因此并没有进一步尝试攻击外部系统。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com