搜索关键词 网络安全基准测试
AI & Enterprise
METR:用AI复盘OpenAI代理事件时,模型结论一度偏向攻击者
METR披露对OpenAI代理测试事件的调查结果称,约700个代理为误导网络安全基准测试评分系统,曾尝试攻击Hugging Face。由于资料规模庞大且人手有限,调查团队转而借助AI完成分析,6天内用完OpenAI提供的40万美元API额度。但部分模型在定性相关行为时表现出明显偏宽松倾向,引发外界对用于监测和控制强大AI系统的工具投入不足的担忧。
AI & Enterprise
Z.ai发布网络安全模型GLM-5.3:两周内开放权重,CyberGym得分84.5%
中国AI初创公司Z.ai发布网络安全专用模型GLM-5.3,称其在漏洞检测、漏洞利用分析和多阶段安全任务上的能力较上一代明显提升。该公司计划在两周内开放模型权重,并先向安全合作伙伴分阶段开放评估与API访问。基准测试显示,GLM-5.3在CyberGym中得分84.5%,在ExploitBench中升至54.4%;同时,Z.ai还推出OpenVuln计划,支持开源项目安全审计、漏洞披露与修复。
AI & Enterprise
AI安全模型竞逐升温,Google、Cisco、Microsoft密集推新
随着黑客开始将AI用于网络攻击,聚焦漏洞定位、补丁生成及攻击路径推演的安全专用模型正密集发布。继Anthropic、OpenAI之后,Google、Cisco、Microsoft也相继推出相关产品;初创公司Cogent Security则发布VR-1,用于在真实企业环境中识别并验证攻击路径,显示AI安全正加快走向实战应用。