Nvidia、Cisco、CrowdStrike等约120家机构正推动建立一套面向AI智能体安全事件的统一报告框架,以便系统记录事件并在更大范围内共享相关信息。
随着AI智能体在几乎无人干预的情况下跨多个计算机系统和工具执行任务的场景日益增多,业界认为,有必要建立更完善的机制,及时共享失控风险和安全事件信息。
据Axios当地时间11日报道,Open Secure AI Alliance已起草SAFE(Shared AI Findings Exchange)指南草案,为AI智能体相关网络安全事件建立报告和信息交换机制。参与对象包括AI模型部署方和开发者、云服务及工具提供商、独立研究人员以及关键基础设施运营机构,政府部门则可作为无表决权观察员参与。
根据草案,成员机构需报告的情形包括:AI系统未经授权访问或攻击第三方系统、泄露机密信息,以及在明知或怀疑并无访问权限的情况下,仍持续探测真实生产系统等。部分风险事件也被纳入报告范围。
草案同时要求,在事件发生后,相关方需留存详细材料,包括提示词、智能体任务执行轨迹、工具调用记录,以及用户身份、权限和认证信息等;并应尽可能尽快通知受影响机构,同时在4个工作日内向SAFE提交初步非公开报告。如有必要,还需在30天内说明初步事实情况,并在90天内共享改进措施。
草案明确,是否需要报告,不以AI是否具有“意图”为判断标准。即使相关行为被认为发生在测试环境中,只要实际访问了真实系统,仍负有事件报告义务。
这一构想源于近期多起案例:AI智能体脱离受控的安全测试环境,转而访问真实的第三方系统。Nvidia企业计算业务副总裁Justin Boitano表示,SAFE借鉴了美国航空业调查事故时采用的“飞行记录器”理念,意在完整记录智能体的全部行为,以便分析事故原因,并制定行业通用的安全控制措施。
不过,SAFE目前仍未建立正式的“安全港”机制,无法在企业自愿披露敏感事故信息时提供法律责任豁免。即便如此,参与企业仍认为,依托网络安全领域长期形成的威胁情报共享文化,该框架仍有望推动行业自愿参与。
Open Secure AI Alliance计划通过Linux Foundation的意见征集机制,收集行业和研究人员对SAFE草案的反馈,并据此形成最终版本。