Moonshot AI发布的Kimi K3模型。图片来源:Moonshot AI(X)

美国白宫高级科技官员公开指责中国AI初创公司Moonshot AI,称其未经授权利用Anthropic模型输出,通过“蒸馏”方式开发新模型Kimi K3。相关争议出现之际,Moonshot AI正准备向公众开放Kimi K3的完整权重。

据媒体Cryptopolitan 22日报道,白宫科学技术政策办公室主任Michael Kratsios当天在X(原Twitter)发文称,Moonshot AI搭建了一套专门的内部系统,用于从美国AI模型中批量获取输出结果,并据此开展大规模蒸馏训练。

Michael Kratsios表示,Moonshot AI曾反复更换访问路径以规避追踪,并以隐蔽方式推进工业规模的蒸馏操作,以获取美国技术。他称,“窃取美国专有技术、削弱美国研究成果的工业级隐蔽蒸馏,是不可接受的。”

此次争议的核心在于AI行业常见的“蒸馏”训练方法,即让较弱模型学习强模型的输出结果,从而模仿其能力。在公开测试或有限场景中,这类做法并不罕见;但Michael Kratsios认为,Moonshot AI所涉行为属于非公开、大规模实施,其性质已超出常规工程范畴,更接近盗用技术。

这一说法也与Anthropic今年2月披露的调查相呼应。Anthropic当时称,已追踪到超过340万条Claude对话流向Moonshot AI,并发现有数百个虚假账号参与其中。Anthropic还表示,部分账号线索与Moonshot AI高层员工的公开信息相互对应,相关活动主要针对Claude的推理、编程和视觉能力。

Michael Kratsios还称,相关工作使用了部署在泰国、搭载NVIDIA GB300的服务器。他指出,按照美国出口管制规定,这类高性能芯片不得进入中国。

Moonshot AI于本月16日发布Kimi K3。公司将其描述为一款拥有2.8万亿参数的开源模型,并在公开发布两天后暂停Kimi新用户注册。该模型的完整权重预计将于27日开放。

Anthropic认为,若模型通过复制方式生成,在公开后可能无法保留原模型的安全防护机制;而一旦权重被开放,相关模型也可能扩散至难以控制的范围。Anthropic担忧,这类开源权重模型可能脱离任何主体的有效监管。

截至目前,Moonshot AI尚未公开回应上述指控。Michael Kratsios也未说明美方可能采取何种制裁措施。此前在2025年1月,David Sacks(AI事务负责人)曾指控DeepSeek复制OpenAI模型,DeepSeek当时予以全面否认;中国政府也曾驳斥Anthropic今年2月的调查结论,称其缺乏依据。

此次交锋发生在中美计划于9月举行AI磋商的背景下。尽管美国在AI投资规模上仍明显领先,中国研究机构与美国模型之间的性能差距也在持续缩小。围绕Kimi K3的这场争议,进一步将中美AI竞争的焦点引向训练数据、芯片管制以及开源模型扩散等议题。

关键词

#Moonshot AI #Kimi K3 #Anthropic #Claude #模型蒸馏 #白宫科学技术政策办公室 #NVIDIA GB300 #出口管制 #开源模型
版权所有 © DigitalToday。未经授权禁止转载或传播。