搜索关键词 NVL72
Industry
Supermicro开始交付NVIDIA Vera Rubin NVL72机架:按扩展单元销售,每单元支持1152块GPU
Supermicro宣布,已开始交付集成DCBBS与DLC-2直液冷技术的NVIDIA Vera Rubin NVL72机架,并按扩展单元进行销售与交付。公司表示,每个扩展单元可支持1152块GPU和331TB HBM4内存,同时提供从现场勘察、方案设计到测试、部署及后续支持的一体化服务。
AI & Enterprise
Cisco与NVIDIA扩展“Secure AI Factory”,纳入Supermicro服务器
Cisco将把Supermicro服务器纳入其与NVIDIA联合推进的“Secure AI Factory”,首批产品计划于10月交付。新系统采用高密度GPU配置,并引入覆盖机架及互连层的液冷架构,可支持万亿参数模型训练以及多平台高吞吐推理。同时,Cisco还面向NeoCloud和主权云客户推出通过NVIDIA Cloud Partner(NCP)认证的解决方案。
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
NVIDIA宣布,面向AI代理的推理加速器Groq 3 LPX已进入量产,并在Hot Chips 2026上正式亮相。该方案可与Vera Rubin NVL72配合,将长上下文处理与解码环节拆分。在Artificial Analysis基准测试中,Groq 3 LPX在10万token上下文窗口下运行Gemma 4 31B时,生成速度最高达到每秒3400个token。Nebius Group等企业将率先部署这一方案。
-
AI & Enterprise
SpaceXAI大规模采用NVIDIA Vera CPU,计划于2027年部署在轨AI系统
-
Industry
NVIDIA在Hot Chips 2026发布多项新品,瞄准AI推理Token生成速度
-
Industry
韩国GW级AI工厂建设提速:服务器组装与液冷供应链仍由中国台湾厂商主导
-
Games & Commerce
Naver加码AI Factory,切入AI基础设施B2B市场
-
AI & Enterprise
Tesla申请“Megapod”商标,布局模块化AI数据中心
-
Industry
AI数据中心供电架构转向机架级备电,BBU需求升温
-
AI & Enterprise
韩国科技部长官拟向Jensen Huang争取年内优先供应Rubin GPU
-
AI & Enterprise
韩国副总理Bae Kyung-hoon会见NVIDIA CEO Jensen Huang,聚焦算力基础设施与Physical AI生态合作
-
AI & Enterprise
NVIDIA AI CPU“Vera”首批基准曝光:部分性能逼近AMD EPYC双路旗舰配置
-
AI & Enterprise
Cerebras上线Kimi K2.6企业级推理服务:速度达981 token/s
-
AI & Enterprise
Dell联手NVIDIA升级AI Factory,布局从桌面Agentic AI到机架级基础设施
-
AI & Enterprise
NVIDIA面向超1万名NVIDIA员工推出GPT-5.5 Codex,部署于Blackwell系统
-
AI & Enterprise
NVIDIA与Google Cloud加码AI合作,推出NVIDIA Vera Rubin A5X裸金属实例
-
Industry
NVIDIA:AI芯片竞争转向端到端效率,Blackwell在MoE推理中较上一代Hopper快55倍
-
AI & Enterprise
韩国政府AI算力项目启动第二轮招标:5家机构角逐,Coupang再度冲刺