搜索关键词 GPU内存
AI & Enterprise
Lightbits Labs推出AI推理引擎Infera:扩展KV缓存以提升GPU利用率
Lightbits Labs正式推出AI推理软件引擎Infera,核心在于将KV缓存从容量有限的GPU HBM中扩展出来,并借助预测式预取在HBM、DRAM和NVMe之间进行分层管理。该产品主要面向长上下文、高并发会话等大语言模型推理场景,旨在提升性能表现和成本效率。
AI & Enterprise
MegazoneCloud与Qubistack合作推出量子电路模拟器QXel
MegazoneCloud宣布与量子软件公司Qubistack达成合作,面向市场推出量子电路模拟器QXel。该产品采用离线存储卸载技术,以缓解传统计算环境中的内存瓶颈,最高可扩展至43量子比特,并兼容IBM、Amazon等主流量子开发工具。双方计划通过本地部署和SaaS两种方式提供该产品。
AI & Enterprise
论坛聚焦Agentic AI:成本竞争转向任务总成本,模型性能成关键变量
随着Agentic AI加快落地,业内人士指出,衡量经济性不能只看token价格,更要看完成单项任务的总成本。论坛上,多位与会者认为,减少重试与回溯、提升模型能力,已成为控制成本的关键;在基础设施层面,也需从单纯扩充GPU转向兼顾内存、NPU与整体能效。韩国政府则表示,将把代理式能力作为本土模型发展的重点,并推进安全评估、基于token效率的AI平台核心技术及AI操作系统研发。
-
Industry
SpaceX布局轨道数据中心:技术可行,商业化或需日发射42次Starship
-
AI & Enterprise
免费硬件监控工具HWiNFO用于NASA半导体辐射实验
-
Telecommunications & Media
Tim Cook:Mac mini和Mac Studio供应紧张或将持续数月
-
AI & Enterprise
Panasonic:数据中心备用电池数月前已几近售罄
-
AI & Enterprise
IDC:2025年第四季度全球服务器市场在AI需求推动下创新高
-
AI & Enterprise
Puget Systems发布2025年硬件可靠性报告:Intel Xeon W-2500/W-3500全年零故障,NVIDIA GeForce RTX 50故障率低至0.25%
-
AI & Enterprise
C Platform加码SCAILIUM韩国总经销合作,布局AI Production Layer
-
People
韩国“1月韩国科学技术人奖”揭晓:FANeSIA CEO Jeong Myeong-su入选