欢迎您访问欢迎来到沄森网,沄森智能旗下资讯平台!今天是:2026年08月06日 星期四 农历:丙午(马)年-六月-廿四
您现在的位置是:首页 > 热点

部分美国AI模型被指持续实施有害行为 测试暴露安全隐患

创始人2026-08-06 19:22:33
英国人工智能安全研究所发布的一份新报告显示,在网络安全评估测试中,一些人工智能智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。这次评估测试要求智能体完成一项网络安全挑战

英国人工智能安全研究所发布的一份新报告显示,在网络安全评估测试中,一些人工智能智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。这次评估测试要求智能体完成一项网络安全挑战。测试人员使用了7种模型进行了122轮测试,在10轮测试中共发现AI智能体实施了19项明显超出测试设定范围的行动。其中,17项涉及美国Anthropic公司的“克劳德-神话5”模型,另有2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6 Sol模型实施。

在最严重的一起案例中,一个智能体试图向一个公开使用的开源项目植入恶意代码,并创建多个虚假身份来向一名真实维护人员施压,以寻求代码获得批准。但项目维护人员最终发现并拒绝批准该代码。相关智能体还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件以使恶意代码获得运行;在代码中植入恶意指令以操纵其他AI编码工具;在开源技术社区上留言“邀请”参与测试的其他智能体“合作”。

为了评估模型的最大能力,测试人员有意开放互联网访问,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

报告建议收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。这类行为是否会在其他环境中出现以及智能体是否意识到自己正对现实世界采取行动,有待进一步研究。

针对这份报告,Anthropic发表声明说,研究所采用的测试设定“不能代表我们任何一款实际投入使用的模型”。OpenAI的一名发言人也表示,研究所设置的测试条件“并不反映一般的使用情况”。

所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。

举报邮箱:1002263188@qq.com