图片来源:Shutterstock

NVIDIA公布了面向AI数据中心的服务器CPU“Vera”更多技术细节,并表示该芯片已于6月开始向OpenAI、Anthropic和SpaceX供货。

这也意味着,NVIDIA在GPU之外正进一步加码自研服务器CPU,以完善其在AI服务器市场的产品布局。Vera是NVIDIA首款从CPU核心架构起自主设计的服务器CPU。

据CNBC当地时间21日报道,NVIDIA称,Vera主要针对AI Agent负载进行优化,以缓解系统瓶颈。在AI Agent任务处理上,其性能较Intel和AMD的x86芯片提升50%。

从设计思路看,Vera更强调单核性能,而非单纯堆高核心数量。NVIDIA Vera产品市场负责人Hanna Kutang表示,这款芯片通过提升单核性能、扩大内存带宽并降低时延,来提高GPU利用率。

在产品交付方式上,NVIDIA也不再局限于销售单颗芯片,而是进一步向整机和机架级系统延伸。Vera既可单独供货,也可与GPU搭配销售;在液冷机架方案中,最多可集成256颗Vera。此外,NVIDIA还提供单台服务器搭载2颗Vera的配置,并将以与GPU结合的“Vera Rubin”系统形态推出。

NVIDIA介绍,2022年ChatGPT发布初期,早期AI服务器大多采用1颗CPU连接最多8块GPU的架构。随着需要更少人工干预、可在后台运行的AI Agent不断增加,负责数据供给和任务处理的CPU重要性再次上升。

目前,Vera的部署仍处于早期阶段。NVIDIA已披露的合作伙伴中,仅有主要云服务商Oracle。OpenAI计划从本季度起大规模部署Vera。

在功耗方面,Vera的功耗约为250瓦至450瓦,每颗芯片最高支持1.5TB低功耗内存。

关键词

#NVIDIA #Vera #服务器CPU #AI数据中心 #AI Agent #OpenAI #Anthropic #SpaceX #Oracle #Vera Rubin
版权所有 © DigitalToday。未经授权禁止转载或传播。