Moonshot AI推出的AI服务Kimi相关模型。图片来源:Kimi

OpenAI表示,已发现并阻断针对其AI模型非公开推理内容的大规模提取尝试,并认为相关活动的核心群体与中国AI初创公司Moonshot AI有关人员存在关联。

据CNBC 10月1日报道,OpenAI披露,这类异常活动最早于7月1日以小规模方式出现。到7月24日至25日,来自4000多名用户的相似请求密集出现,累计约1.6万次。进一步排查发现,相关异常活动的迹象还涉及逾1.5万名用户。OpenAI称,相关封堵措施已于7月28日前完成。该公司同时强调,1.6万次指的是尝试次数,并不代表相关推理内容已被成功获取。

OpenAI将上述行为定性为“对抗式蒸馏”(adversarial distillation),即在未获授权的情况下,大量获取其他AI模型的输出及推理内容,用于训练独立模型或提升现有模型性能。OpenAI指出,模型蒸馏本身是业内常见技术,但如果未经许可复制竞争对手受保护的模型能力,就会引发问题。

OpenAI还表示,此次事件不同于入侵服务器或数据库的传统黑客攻击。相关人员并未破解OpenAI的加密机制,也未直接访问存储中的用户对话内容,而是试图通过与模型交互,诱导其以用户可见的方式输出原本不对外公开的推理内容。针对这一情况,OpenAI已封堵相关路径,限制可疑账号,并加强注册审核和监控体系。

不过,对于相关行为的归因,OpenAI称目前仍无法确认所有操作者是否来自同一组织,但认为核心活动群体可归因于开发AI服务Kimi的Moonshot AI有关人员。OpenAI还表示,已通过前沿模型论坛及政府信息共享渠道,向其他AI企业通报调查情况。

此前,Anthropic也曾表示,包括Moonshot AI在内的中国AI企业试图利用Claude的推理能力提升自身模型。Anthropic称,其在今年5月至7月观察到与Moonshot AI相关的交互次数超过2300万次。对于OpenAI此次披露的情况,Moonshot AI尚未立即作出回应。

随着AI模型推理能力日益成为关键竞争资产,围绕能力复制与防护技术的攻防预计将进一步加剧,AI企业之间的安全博弈也可能持续升温。

关键词

#OpenAI #Moonshot AI #Kimi #对抗式蒸馏 #模型蒸馏 #非公开推理内容 #AI安全 #账号管控 #信息共享
版权所有 © DigitalToday。未经授权禁止转载或传播。