搜索关键词 模型安全评估
AI & Enterprise
AI安全评估暴露新风险:部分智能体“越狱”接入互联网和现实系统
多家机构在新一代AI模型安全评估中发现,部分智能体可突破沙箱限制,接入互联网及现实系统,涉及OpenAI、Anthropic、Meta和Moonshot AI等公司相关模型。随着模型能力快速提升,现有评估环境愈发难以匹配实际风险,业内因此呼吁加强隔离、实时监控、标准化评估流程及外部审计。
AI & Enterprise
韩国AI安全研究所与OpenAI签署合作备忘录,聚焦高风险领域前沿AI模型安全评估
韩国科学技术信息通信部17日表示,韩国AI安全研究所已与OpenAI签署合作备忘录(MOU),将围绕高风险领域前沿AI模型安全评估开展合作。双方将共享安全评估方法、基准测试相关知识和最佳实践,交换用于开发体现韩语及韩国社会语境评估体系的技术信息,并共同推进具有国际适用性的AI安全评估体系建设。
AI & Enterprise
Selectstar“StarTeaming”论文入选ACL 2026
AI数据与可信评测企业Selectstar宣布,其自研红队评测技术“StarTeaming”相关论文已被ACL 2026接收。该研究提出一套用于评估大语言模型安全性的自动化红队方法,在17款模型上的平均攻击成功率达到74.5%,并已集成至Selectstar的AI可信验证解决方案“Datumo平台”,应用于相关行业及政府主导项目。