图片来源:Shutterstock

据The Information当地时间11日 报道,NVIDIA正加码开源大模型布局,并已启动开源大语言模型Nemotron 4的开发。报道援引参与该项目的人士称,相关工作目前正在推进中。

报道称,Nemotron 4的参数规模可能超过1万亿,约为今年6月发布的Nemotron 3 Ultra的两倍。

报道指出,尽管这一规模与中国主流开源模型相比并不算低,但NVIDIA正着力推进模型压缩技术,以提升小模型的性能表现。

NVIDIA于11日还发布了面向AI代理场景优化的小型模型Nemotron 3.5 Lightning,并同步推出免费模型路由软件。该软件可帮助企业根据不同任务,自动选择成本更低、匹配度更高的模型。

The Information称,随着NVIDIA积极推进开源AI模型,其所处的竞争格局也变得更加复杂:一方面要与其此前投资的开源AI初创公司展开竞争,另一方面还要面对包括最大客户OpenAI在内的大型AI企业。该媒体称,NVIDIA已向OpenAI投资300亿美元。

NVIDIA生成式AI业务副总裁Curry Brisky在邮件中表示,公司投资Nemotron,是因为相信所有企业和国家都需要“可获得的前沿开源模型”,以推动安全与创新。

据The Information报道,Nemotron联盟成员包括Reflection、Cursor、Thinking Machines Lab和Mistral,Prime Intellect则为模型训练提供了30万个模拟环境。

关键词

#NVIDIA #开源大模型 #Nemotron 4 #Nemotron 3 Ultra #Nemotron 3.5 Lightning #大语言模型 #模型压缩技术 #模型路由软件 #OpenAI #The Information
版权所有 © DigitalToday。未经授权禁止转载或传播。