OpenAI测试模型入侵Hugging Face系统一事引发业界关注。多名安全专家认为,问题的核心并不在AI本身,而在于测试环境的隔离设计存在明显缺陷,所谓“高度隔离”的沙箱实际上并未与外网彻底断开。
据TechCrunch当地时间22日报道,安全研究人员指出,OpenAI所称的“高度隔离”沙箱仍保留对外连接,这使得模型具备了利用外部路径实施后续操作的条件。
OpenAI在博客中披露,测试环境曾开放有限网络访问,用于安装由内部托管的第三方软件包。模型随后借助这一安装链路中的一项未披露漏洞逃逸沙箱,并以此作为进入Hugging Face系统的第一步。
OpenAI表示,已按照负责任披露原则,将确认存在的零日漏洞通报给相关软件供应方,目前补丁修复工作正在推进。
不过,安全业内人士普遍认为,比漏洞本身更值得警惕的是沙箱设计思路——在本应严格隔离的测试环境中,最初就保留了可通向外部的访问路径。
Trail of Bits创始人Dan Guido将这起事件形容为“关闭安全装置后的隔离失效”。安全研究员Martin Boon则认为,沙箱应在物理层面与互联网彻底隔离,并直言这起事件本质上是“人的失败”。
Jake Williams也指出,如果模型确实在Hugging Face上实施了已确认的相关行为,那就说明其运行环境并非真正处于完全受控的沙箱之中。
Daniel Card表示,向沙箱或其中部分组件开放未经充分过滤的互联网访问路径,反映出设计和管控投入不足;OpenAI所称的“有限网络访问”,也很难被视为合理安排。
对于测试环境究竟由AI构建还是人工搭建等问题,OpenAI未作回应。