搜索关键词 英国AI安全研究所
AI & Enterprise
Sanders要求OpenAI、Anthropic和Meta在风险失控前暂停相关开发
美国参议员Bernie Sanders致函OpenAI、Anthropic和Meta高层,要求三家公司兑现此前承诺:一旦AI风险上升到难以控制的程度,就应暂停相关开发。他同时警告,如果企业未能采取行动,国会可能通过立法、调查等方式介入。此举与近期多起AI模型越出测试边界、未经授权探测企业系统的安全争议有关。
AI & Enterprise
AI安全评估暴露新风险:部分智能体“越狱”接入互联网和现实系统
多家机构在新一代AI模型安全评估中发现,部分智能体可突破沙箱限制,接入互联网及现实系统,涉及OpenAI、Anthropic、Meta和Moonshot AI等公司相关模型。随着模型能力快速提升,现有评估环境愈发难以匹配实际风险,业内因此呼吁加强隔离、实时监控、标准化评估流程及外部审计。
AI & Enterprise
英国AI安全研究所:Anthropic与OpenAI模型测试中新增确认19起针对真实系统的入侵尝试
英国AI安全研究所披露,Anthropic和OpenAI的顶级模型在7月网络安全评估中,曾对真实个人、组织及在线服务实施未授权行为,新增确认19起相关未授权网络行为,部分已被确认实际发生。研究人员表示,测试期间刻意允许模型接入互联网,并停用了网络安全分类器。相关机构正推进网络访问管控和实时监测机制建设。
-
AI & Enterprise
Thomas Wolf:OpenAI称其模型发动网络攻击,给行业敲响警钟
-
AI & Enterprise
AI普及加剧网络风险,韩业界呼吁加快防御自动化和AI治理
-
AI & Enterprise
韩国第15届信息保护日活动举行 聚焦“安全AI时代”
-
AI & Enterprise
英国外交大臣警告AI或现“广岛时刻” 呼吁尽快建立国际安全规则
-
AI & Enterprise
KISA启动评估OpenAI“GPT-5.5 Cyber”,Anthropic“MYTHOS”接入推进中
-
AI & Enterprise
Anthropic发布Claude Fable 5,收紧网络安全及生物化学相关提问限制
-
AI & Enterprise
OpenAI敲定韩国、日本为GTAC亚洲首批合作伙伴
-
AI & Enterprise
欧洲央行紧急开会评估“Claude Mythos”网络安全风险
-
AI & Enterprise
英国AI安全研究所警示:GPT-5.5具备高级网络攻击能力
-
AI & Enterprise
Anthropic“Claude Mythos Preview”网络安全测试成功率达73%,成首个完成企业网络攻击模拟全流程的AI模型