搜索关键词 Gemma 4 31B
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
NVIDIA宣布,面向AI代理的推理加速器Groq 3 LPX已进入量产,并在Hot Chips 2026上正式亮相。该方案可与Vera Rubin NVL72配合,将长上下文处理与解码环节拆分。在Artificial Analysis基准测试中,Groq 3 LPX在10万token上下文窗口下运行Gemma 4 31B时,生成速度最高达到每秒3400个token。Nebius Group等企业将率先部署这一方案。
Industry
NVIDIA在Hot Chips 2026发布多项新品,瞄准AI推理Token生成速度
在Hot Chips 2026大会上,NVIDIA赶在二季度财报发布前推出多款面向AI推理和网络基础设施的新产品,包括启动量产的Grok 3 LPX、以太网扩展方案Spectrum-X Multiplane以及基础设施加速方案ScaleIn。公司同时披露,Vera CPU已被SpaceXAI采用;整体布局聚焦AI推理阶段的Token生成速度、网络扩展能力以及面向AI智能体的计算架构。
AI & Enterprise
NVIDIA发布5500亿参数开源大模型Nemotron 3 Ultra,Vera Rubin平台进入量产阶段
NVIDIA发布参数规模达5500亿的开源大模型Nemotron 3 Ultra,并表示将于本周正式开源发布。与此同时,下一代AI服务器平台Vera Rubin也已进入量产阶段,以Rubin GPU和自研Vera CPU为核心,瞄准企业级AI及Agent AI带动的数据中心需求。