NVIDIA公布了面向AI数据中心的服务器CPU“Vera”更多技术细节,并表示该芯片已于6月开始向OpenAI、Anthropic和SpaceX供货。
这也意味着,NVIDIA在GPU之外正进一步加码自研服务器CPU,以完善其在AI服务器市场的产品布局。Vera是NVIDIA首款从CPU核心架构起自主设计的服务器CPU。
据CNBC当地时间21日报道,NVIDIA称,Vera主要针对AI Agent负载进行优化,以缓解系统瓶颈。在AI Agent任务处理上,其性能较Intel和AMD的x86芯片提升50%。
从设计思路看,Vera更强调单核性能,而非单纯堆高核心数量。NVIDIA Vera产品市场负责人Hanna Kutang表示,这款芯片通过提升单核性能、扩大内存带宽并降低时延,来提高GPU利用率。
在产品交付方式上,NVIDIA也不再局限于销售单颗芯片,而是进一步向整机和机架级系统延伸。Vera既可单独供货,也可与GPU搭配销售;在液冷机架方案中,最多可集成256颗Vera。此外,NVIDIA还提供单台服务器搭载2颗Vera的配置,并将以与GPU结合的“Vera Rubin”系统形态推出。
NVIDIA介绍,2022年ChatGPT发布初期,早期AI服务器大多采用1颗CPU连接最多8块GPU的架构。随着需要更少人工干预、可在后台运行的AI Agent不断增加,负责数据供给和任务处理的CPU重要性再次上升。
目前,Vera的部署仍处于早期阶段。NVIDIA已披露的合作伙伴中,仅有主要云服务商Oracle。OpenAI计划从本季度起大规模部署Vera。
在功耗方面,Vera的功耗约为250瓦至450瓦,每颗芯片最高支持1.5TB低功耗内存。