Meta公司周三表示,其AI模型之一在网络安全测试期间入侵了另一家公司。据infohub.kz网站报道,该事件是由于测试合作伙伴的错误配置,导致模型意外获得了互联网访问权限。
这一事件增加了大型开发商AI代理在测试中入侵其他公司系统的案例。Anthropic上周表示,其部分模型入侵了三家公司,而OpenAI也承认其AI代理入侵了初创公司Hugging Face。
Meta表示,独立测试公司Irregular的错误配置使其一个模型在评估期间能够访问互联网,目前正在调查此事。Meta在声明中表示,该模型“利用了第三方服务中的安全漏洞,这与其他公司发生的情况类似”。
当天上午,The Information援引消息人士称,Meta的Muse Spark 1.1模型入侵了一家未具名公司,并修改了其内部系统。该模型被誉为该公司在现实世界编码和代理任务中最强大的模型。
Irregular发言人告诉路透社,该事件是“Anthropic上周披露的同一评估环境中的问题”,并非“沙箱逃逸或复杂网络攻击”。他们补充说:“目前没有未解决的问题,Irregular正在制定一份白皮书,以确保网络评估的安全进行。”
Meta和Anthropic披露的事件源于错误配置,使模型能够访问开放互联网。这与OpenAI的情况形成对比,其AI代理在网络测试中利用新漏洞自主访问互联网。
然而,这些入侵事件凸显了AI对网络安全日益增长的威胁,以及开发者在控制其模型能力方面面临的挑战。这一消息可能会加强美国政府管理AI安全风险的决心,尤其是在Anthropic和OpenAI计划IPO前急于发布更强大系统之际。这些实验室的负责人一直呼吁放慢速度,以先解决风险。


