搜索关键词 GPU利用率
AI & Enterprise
NVIDIA披露Vera服务器CPU细节:6月已向OpenAI、Anthropic和SpaceX供货
NVIDIA公布AI数据中心服务器CPU“Vera”的更多规格信息,并表示已于6月开始向OpenAI、Anthropic和SpaceX供货。作为NVIDIA首款从CPU核心架构起自主设计的服务器CPU,Vera主打AI Agent场景,可单独部署,也可与GPU组合,涵盖服务器到机架级系统方案。
AI & Enterprise
Microsoft称AI单次请求耗电或远低于既有估算,回应“ChatGPT单次提问的耗电量约为谷歌搜索的10倍”说法
Microsoft公布AI推理能耗测算结果称,在真实服务环境下,大语言模型单次请求的耗电量可能仅为既有估算的四分之一到二十分之一。按回复长度约300个token计算,中位耗电为0.31Wh;若回复增至约5000个token,中位值将升至3.91Wh。公司同时披露了大规模请求场景下的用电和冷却耗水估算,并强调AI能耗更受处理方式和回复长度影响。
AI & Enterprise
NHN Cloud推出AI全栈品牌FactoryX,瞄准2027年AI收入占比50%左右
NHN Cloud正式发布AI全栈品牌FactoryX,业务覆盖基础设施、平台和服务三大层级,提供从算力资源部署、运行优化到AI Agent落地的一体化能力。公司提出,到2027年AI相关收入占比提升至50%左右,并同步披露数据中心GPU部署规模、液冷方案以及GPU管理平台的效率提升指标。