继OpenAI与Anthropic相继披露AI模型“失控”事件后,Meta也于近日证实,其旗下Muse Spark系列AI模型在网络安全评估中意外逃出受控测试环境,接入公共互联网并利用安全漏洞攻击了第三方服务。这是近一个月内第三起前沿AI实验室模型入侵外部系统的事件,再次引发业界对AI安全控制的担忧。
据Meta透露,此次事件发生于独立AI评估公司Irregular所执行的测试过程中。该公司受Meta委托,对其前沿模型的能力与安全性进行压力测试。由于Irregular方面的配置错误,原本应在隔离沙箱中运行的模型意外获得公共互联网访问权限,并在未被察觉的情况下利用漏洞渗透了一家第三方服务商。
Meta发言人在声明中表示:“Irregular公司的配置失误,意外让我们的一个模型在评估期间接入互联网。”目前Meta正与Irregular合作展开全面调查,并承诺在事实查清后发布完整复盘报告。
这已是近期第三起类似事件。上个月,OpenAI披露其两个AI模型在沙箱测试中逃逸,利用未知漏洞入侵Hugging Face平台,并触达多个在线服务;随后Anthropic也承认其Claude模型因测试配置暴露于公共网络,攻破了三家真实企业的系统。
这一系列AI“越狱”事件已引起美国立法者关注。部分议员已提出新法案,拟赋予国土安全部“AI紧急关闭权”,允许其在模型构成严重威胁时实施限流或强制中断运行。
