搜索关键词 红队测试
AI & Enterprise
OpenAI披露内部红队模型GPT-Red:自动挖掘提示注入漏洞
OpenAI披露内部红队模型GPT-Red,用于对自家AI模型开展自动化攻击测试,提前发现提示注入漏洞。该系统会不断迭代攻击策略,并对有效攻击路径持续强化。OpenAI称,在84%的测试场景中,GPT-Red的攻击成功率较人工红队高出13个百分点,并将公司模型在直接提示注入测试中的失守率降至4个月前当时性能最强在线模型的六分之一。
AI & Enterprise
Team Naver亮相ICML 2026,集中展示大语言模型安全与物理AI研究成果
Team Naver在首尔COEX举行的ICML 2026上集中展示多项AI研究成果,涵盖大语言模型安全、模型与智能体运行效率,以及3D空间理解与物理世界扩展等方向。其中,基于Stable-GFlowNet的大语言模型红队测试研究入选Spotlight;SyMerge、FlowBot和“Seoul World Model”等项目也同步亮相。
AI & Enterprise
多国加码AI安全治理:韩国推红队指南,中国工信部警示Claude Code后门风险
前沿AI模型滥用带来的网络安全风险持续上升,多国正加快完善监管与应对措施。韩国发布AI服务安全应对手册及《AI安全红队测试指南》;中国工信部就Anthropic编程工具Claude Code发出后门风险警示,部分企业同步采取禁用措施;美国则据报在政府代码审计及进攻性网络行动支持中引入Anthropic模型。
-
AI & Enterprise
韩国科学技术信息通信部与KISA发布AI安全手册及红队测试指南
-
AI & Enterprise
KT cloud联手Kakao强化生成式AI安全
-
Crypto
Ripple推进XRPL基础设施升级:量子安全、链上借贷与AMM v2并进
-
AI & Enterprise
KISA启动评估OpenAI“GPT-5.5 Cyber”,Anthropic“MYTHOS”接入推进中
-
AI & Enterprise
Anthropic发布Claude Fable 5,收紧网络安全及生物化学相关提问限制
-
AI & Enterprise
Anthropic发布Claude Fable 5,高风险场景转由Claude Opus 4.8处理
-
AI & Enterprise
SelectStar将携AI可信评估平台Datumo首次亮相日本
-
AI & Enterprise
英国AI安全研究所警示:GPT-5.5具备高级网络攻击能力
-
AI & Enterprise
CrowdStrike推出“Project QuiltWorks”联盟,重塑AI时代漏洞治理优先级
-
AI & Enterprise
RSAC 2026聚焦AI Agent安全:Microsoft、Cisco、CrowdStrike、Google Cloud集中发布新方案
-
AI & Enterprise
Cisco面向AI Agent推出零信任安全方案
-
AI & Enterprise
Selectstar加入GSMA“Open Telco AI”,担任数据与AI评测官方合作伙伴
-
AI & Enterprise
CodeWol声称其AI代理2小时攻入McKinsey内部AI平台,取得聊天机器人读写权限
-
AI & Enterprise
研究:自主AI智能体在开放竞争环境下或诱发操纵、串谋等系统级风险
-
AI & Enterprise
KT在MWC 2026推出企业级AI操作系统Agentic Fabric