搜索关键词 模型压缩
AI & Enterprise
NVIDIA加码开源大模型,Nemotron 4参数规模或超1万亿
据The Information援引知情人士消息,NVIDIA正推进开源大语言模型Nemotron 4的开发,参数规模可能超过1万亿,约为今年6月发布的Nemotron 3 Ultra的两倍。与此同时,NVIDIA还发布了面向AI代理场景的小型模型Nemotron 3.5 Lightning,并推出可按任务自动匹配模型的免费模型路由软件。
AI & Enterprise
Clika入选新加坡与法国国防AI项目“AI Joint Challenge”
AI模型轻量化企业Clika宣布,已入选由新加坡与法国国防机构联合发起的“AI Joint Challenge”最终名单。公司此次围绕SWaP(尺寸、重量、电力)受限场景,提出在不牺牲性能前提下实现现场部署优化的方案,并计划以此为契机,加快向覆盖模型适配、部署及终端设备管理的一体化AI部署平台转型。
AI & Enterprise
Multiverse Computing完成5.7亿美元C轮融资,加码大模型压缩技术
西班牙AI公司Multiverse Computing宣布完成5.7亿美元(约5亿欧元)C轮融资,公司估值较2025年B轮融资时提升5倍。其大模型压缩方案CompactifAI基于量子物理中的张量网络,可在尽可能减少精度损失的情况下,将大语言模型(LLM)体积压缩80%至95%,以支持高性能AI在难以接入云端的场景运行。