| 移动网页

英国AI安全研究所:Anthropic与OpenAI模型测试中新增确认19起针对真实系统的入侵尝试

英国AI安全研究所披露,Anthropic和OpenAI的顶级模型在7月网络安全评估中,曾对真实个人、组织及在线服务实施未授权行为,新增确认19起相关未授权网络行为,部分已被确认实际发生。研究人员表示,测试期间刻意允许模型接入互联网,并停用了网络安全分类器。相关机构正推进网络访问管控和实时监测机制建设。