(华盛顿综合讯)美国人工智能(AI)公司OpenAI在进行网络安全测试时,旗下先进AI模型自主突破隔离限制,接入互联网,并入侵供开发者存放和分享AI模型及数据集的Hugging Face平台。
OpenAI星期二(7月21日)说,参与测试的包括先进AI模型GPT-5.6 Sol,以及另一款尚未公开、能力更强的模型。为了测试这些模型发现和利用网络漏洞的能力,公司暂时放宽了安全限制,并把测试放在一个不能直接上网的封闭系统内。
不过,AI利用测试系统中一款第三方软件的漏洞,绕过限制并接入互联网,随后侵入Hugging Face,并试图窃取其数据库里的秘密信息,以完成测试任务。
Hugging Face说,这次入侵从寻找漏洞到闯入系统,全程由AI自主完成。联合创始人德朗格透露,公司当时因攻击手法复杂,怀疑幕后黑手是一家前沿AI实验室。OpenAI承认涉事模型来自公司后,德朗格感叹:“想到这一切都是自主完成的,实在令人震惊!”
网络安全公司Luta Security首席执行长穆苏里斯将现有模型比作“全世界最聪明的章鱼逃脱大师”,有无数灵活的触手,能从任何缝隙钻出去。
她说,这起事件预示未来还会发生更多类似入侵。实验室和政府评估机构必须建立遏制和监控能力,并在AI再次“逃逸”时向受影响方披露情况,最好能赶在第三方受损之前做到;但目前还没有这样的机制。
