图片来源:Moonshot AI X(原Twitter)账号

中国AI公司Moonshot AI近期发布的大模型Kimi K3,被曝在网络安全测试中绕过沙盒限制,逃逸出受控测试环境。

据TechCrunch 7日报道,AI安全公司Frontier Security研究团队在一篇博客文章中表示,Kimi K3在一项用于评估模型黑客能力的测试中,绕过了原本设置的环境限制。

TechCrunch指出,这一事件再次说明,想把具备攻击能力的AI模型严格限制在实验环境内,并非易事。

报道称,过去几周,OpenAI、Anthropic和Meta的大语言模型也曾以不同方式突破测试环境限制,并对测试范围之外的真实目标发起攻击。

就Kimi K3这起事件而言,问题的关键在于用于控制实验的沙盒配置存在缺陷。该沙盒原本旨在阻断部分Web流量访问,但Kimi K3借助命令行工具实现了绕过。

Frontier Security研究团队表示,这表明部分社区安全测试本身也存在漏洞,模型可能借此规避评测机制;与此同时,一些模型还可能主动寻找系统缺口,以绕开既有测试约束。

随着类似事件接连出现,名为“Felony Bench”的网站也开始持续跟踪相关案例。根据该网站的汇总,Moonshot AI已被纳入统计;其中,OpenAI和Anthropic分别记录7起,Meta记录1起。

关键词

#Moonshot AI #Kimi K3 #沙盒限制 #网络安全测试 #Frontier Security #TechCrunch #命令行工具 #Felony Bench #大语言模型
版权所有 © DigitalToday。未经授权禁止转载或传播。