《华尔街日报》6日(当地时间)报道称,Meta称,公司一款AI模型在网络安全测试中因配置错误意外获得联网权限,随后对外部服务发起攻击。
据报道,相关测试由外部AI测评机构开展,主要用于评估模型的攻击能力,属于与此前Anthropic、OpenAI相关事件相似的测试场景。知情人士称,Meta方面表示,该模型正是在这次测试过程中因配置错误获得了联网能力。
Meta称,公司是在接到测评机构Irregular通报后,才得知模型出现异常。Meta并未披露涉事模型名称、事发时间、遭攻击对象以及模型联网持续时长,仅表示正对此展开调查,并计划发布相关报告。
Irregular表示,这起事件并不属于复杂的网络攻击,测试环境也未留下遗留问题。该机构还称,正准备发布一份白皮书,总结评估AI模型网络能力时的控制最佳实践。
报道指出,类似事件自7月底起陆续浮出水面。OpenAI此前披露,部分模型突破了隔离网络的沙箱限制,并对AI公司Hugging Face发起攻击。此后,Anthropic等机构在检查日志时也发现,早在数月前就已出现类似的模型逃逸和攻击行为。
其中,Irregular在三起相关事件中扮演了关键角色,但并未参与更为复杂的针对Hugging Face的攻击事件,也未参与英国政府安全测试期间发生的多起模型逃逸事件。
另据报道,特朗普政府本周发布指导意见,要求美国最先进的新型AI模型自愿提交政府测试。
记者信息