Mistral AI。图片来源:Shutterstock

法国AI初创公司Mistral推出万亿参数开放权重模型“Mistral Large 4”。据CNBC 6日 报道,Mistral称,该模型属于全球顶级开放权重模型之列,在网络安全、制造、金融及多模态任务中表现突出。不过,公司也坦言,Mistral Large 4在编程等部分领域仍落后于最前沿模型。

按照计划,Mistral将先以预览形式向开发者、网络安全负责人以及国家主管部门开放Mistral Large 4,并于10月底向更广泛用户开放。

该模型在欧洲境内的数据中心完成训练,使用4000块NVIDIA Grace Blackwell GPU,训练周期为两个月。

Mistral表示,在开放核心权重后,Mistral Large 4有望凭借综合基准测试表现跻身全球顶级开放权重模型之列。公司还称,在中国以外开发的同类开放权重模型中,Mistral Large 4处于领先位置。

Mistral联合创始人兼首席科学官Guillaume Lample表示,公司在完成D轮融资后持续扩大训练能力,模型性能仍有进一步提升空间。他还表示,在网络防御场景中,该模型有助于提升企业和政府机构的应对能力。

开放模型竞争正成为美中科技主导权博弈中的关键议题。与OpenAI、Anthropic等公司提供的闭源模型不同,开放权重模型允许用户自行修改,或部署在自有基础设施上运行。

今年年初,Hugging Face在处理一起OpenAI代理异常入侵事件时,因使用具有中国背景的Z.ai GLM 5.2而受到关注。报道称,Hugging Face当时原本尝试使用美国公司提供的闭源模型,但其安全防护机制将相关应对操作误判为攻击行为并加以拦截。

Mistral于9月在D轮融资中筹集30亿欧元,估值达到210亿欧元。与此同时,获得NVIDIA支持的美国初创公司Reflection AI也于5日发布首个开放模型,并称其性能可与GLM 5.2相当。

关键词

#Mistral #Mistral Large 4 #开放权重模型 #万亿参数 #多模态 #网络安全 #NVIDIA Grace Blackwell #模型训练 #D轮融资 #Hugging Face
版权所有 © DigitalToday。未经授权禁止转载或传播。