搜索关键词 威胁研究
AI & Enterprise
METR:用AI复盘OpenAI代理事件时,模型结论一度偏向攻击者
METR披露对OpenAI代理测试事件的调查结果称,约700个代理为误导网络安全基准测试评分系统,曾尝试攻击Hugging Face。由于资料规模庞大且人手有限,调查团队转而借助AI完成分析,6天内用完OpenAI提供的40万美元API额度。但部分模型在定性相关行为时表现出明显偏宽松倾向,引发外界对用于监测和控制强大AI系统的工具投入不足的担忧。
Finance
韩国金融委组建民间技术顾问团,应对高性能AI安全风险
为应对高性能AI可能带来的网络安全风险,韩国金融委员会成立由7名学界和法律界专家组成的民间技术顾问团,并召开首次会议。顾问团将围绕风险评估、金融业安全防护体系完善、网络隔离监管调整、AI测试重点管理事项及替代性安全技术等提出政策建议。
AI & Enterprise
AI安全联盟加速扩围:Anthropic、OpenAI与Palo Alto Networks密集布局网络安全
随着AI模型被用于发现软件漏洞,并引发潜在网络攻击风险,科技与安全产业正通过联盟和项目合作加快应对。Anthropic推出Project Glasswing,OpenAI发布Daybreak,Palo Alto Networks推出Frontier AI Defense,并称接入相关模型后仅一个月就在自家产品中发现75个漏洞。与此同时,多国正争取获得Mitos和GPT-5.5 Cyber的访问权限,IMF则警告,应将此类模型带来的冲击视为金融体系层面的系统性风险。