搜索关键词 混合专家架构
Industry
Rebellions称单台自研NPU服务器可提供接近高性能GPU服务器的AI基础设施能力
Rebellions表示,已将自研NPU服务器“Rebel Server”与SK Telecom自主研发的大模型A.X K1结合,在单台服务器上实现接近高性能GPU服务器的AI基础设施能力。公司同时展示了多用户并发智能体服务,并称该方案有望减轻数据中心建设和运营负担。
AI & Enterprise
Z.ai发布开源模型GLM-5.2:基于Huawei Ascend AI加速器训练,FrontierSWE成绩接近Claude Opus 4.8
中国AI公司Z.ai发布新一代开源模型GLM-5.2。公司表示,该模型训练全程基于Huawei Ascend AI加速器,未使用Nvidia硬件。在FrontierSWE、SWE-bench Pro等编程与Agent基准测试中,GLM-5.2成绩位居前列;同时,模型以MIT许可证开源,提供权重和量化版本,并以更低的API定价进入市场。
AI & Enterprise
NVIDIA CEO Jensen Huang:AI正加速迈入Agent AI时代
NVIDIA在Computex主题演讲上宣布,AI产业正从生成式AI迈向Agent AI,公司的战略重心也进一步转向下一代AI基础设施。Jensen Huang同步发布Vera Rubin平台、企业级Agent开发平台和AI工厂架构DSX,并表示未来十年,企业竞争力将取决于AI基础设施的建设、管理与运营能力。