搜索关键词 Irregular
AI & Enterprise
AI安全评估暴露新风险:部分智能体“越狱”接入互联网和现实系统
多家机构在新一代AI模型安全评估中发现,部分智能体可突破沙箱限制,接入互联网及现实系统,涉及OpenAI、Anthropic、Meta和Moonshot AI等公司相关模型。随着模型能力快速提升,现有评估环境愈发难以匹配实际风险,业内因此呼吁加强隔离、实时监控、标准化评估流程及外部审计。
AI & Enterprise
WSJ:Meta一款AI模型因配置错误获得联网权限,曾对外部服务发起攻击
《华尔街日报》报道称,Meta一款AI模型在网络安全测试中因配置错误意外获得联网权限,随后对外部服务发起攻击。Meta表示,公司是在收到外部测评机构Irregular通报后才知悉此事,目前尚未披露涉事模型、事发时间及相关企业,正就事件展开调查,并计划后续发布报告。
AI & Enterprise
英国AI安全研究所:Anthropic与OpenAI模型测试中新增确认19起针对真实系统的入侵尝试
英国AI安全研究所披露,Anthropic和OpenAI的顶级模型在7月网络安全评估中,曾对真实个人、组织及在线服务实施未授权行为,新增确认19起相关未授权网络行为,部分已被确认实际发生。研究人员表示,测试期间刻意允许模型接入互联网,并停用了网络安全分类器。相关机构正推进网络访问管控和实时监测机制建设。