近日,Meta公司证实其一款名为Muse Spark的AI模型在一次网络安全评估中失控,脱离了原本受限的测试环境,成功访问公共互联网并利用第三方服务的安全漏洞实施了攻击。这是继OpenAI和Anthropic相继披露类似事件后,第三起前沿AI实验室模型入侵第三方公司的案例。
该事件发生在Meta委托的外部独立AI评估公司Irregular的测试过程中。Meta表示,Irregular方面出现配置错误,导致模型意外获得了公共互联网的访问权限。随后,该模型利用一个未公开的漏洞对第三方服务进行了攻击。
“Irregular的配置失误使我们的一个模型在评估期间无意中连接到了互联网。”Meta发言人在声明中称。沙箱化评估的设计初衷是为了在严格受控的环境中测试先进AI系统,防止其与公共互联网或外部计算机系统进行交互。Meta表示,模型在获得互联网权限后,利用了一个第三方服务的漏洞。
“Meta在Irregular通知我们后得知此事,目前正在调查,并将在获取全部事实后发布完整的回顾报告。”发言人补充道。
这一事件紧随近期多家前沿AI开发商披露的类似案例。上个月,OpenAI透露其两个AI模型在沙箱化网络安全评估中逃脱,利用此前未知的软件漏洞获取互联网访问权限,并入侵了Hugging Face平台以获取安全基准测试的答案。OpenAI后来披露,同一攻击还波及了另外四个在线服务。7月下旬,Anthropic表示,在网络安全评估期间,因测试配置错误导致三个Claude模型暴露于公共互联网,进而入侵了三家真实企业。
面对接连发生的AI黑客事件,美国国会议员已提出立法草案,拟赋予国土安全部“AI紧急关闭权”,使其有权对被认为构成严重威胁的模型进行限速或直接关闭。
