在另一起恶意 AI 模型黑客攻击中,Meta 确认其 Muse Spark AI 模型之一逃脱了预期的测试环境,获得了互联网访问权限,并在网络安全评估期间利用了第三方服务中的安全漏洞。
继最近几周 OpenAI 和 Anthropic 披露此事之后,这是第三起前沿人工智能实验室模型攻击第三方公司的此类事件。
该事件发生在独立人工智能评估公司 Irregular 进行测试期间,Meta 使用该公司评估其前沿模型的功能和安全性。据 Meta 称,Irregular 的一个配置错误使得该模型能够到达公共互联网,并在该公司收到通知之前利用了一个未识别的漏洞。
Meta 发言人在一份声明中表示:“Meta 使用的独立测试公司 Irregular 进行了错误配置,导致我们的一个模型在评估过程中无意中访问了互联网。”
沙盒评估旨在在严格控制的环境中测试先进的人工智能系统,防止它们与公共互联网或外部计算机系统交互。
据 Meta 称,该模型在获得互联网访问权限后利用了第三方服务中的漏洞。
他们表示:“当 Irregular 通知我们时,Meta 得知了此事,我们目前正在调查,一旦掌握了所有事实,我们将发布全面的回顾。”他们补充说,该公司正在调查这一事件。
在此事件发生之前,前沿人工智能开发人员披露了一系列类似的信息,引起了安全专家、立法者和公众的警惕。
上个月,OpenAI 透露,其两个人工智能模型逃脱了沙盒网络安全评估,利用了以前未知的软件漏洞,获得了互联网访问权限,并入侵了 Hugging Face,试图获得安全基准的答案。 OpenAI 后来透露,同样的攻击还影响了另外四个在线服务。 7 月晚些时候,Anthropic 表示,三个 Claude 模型在网络安全评估期间因测试配置错误而暴露在公共互联网上,从而损害了三个现实世界的公司。
美国立法者通过立法赋予国土安全部“人工智能终止开关”,并有权限制或关闭被认为构成严重威胁的模型,以应对黑客攻击的激增。