搜索关键词 内存占用
Industry
Denotisia发布VDPU四卡服务器方案,向量检索吞吐最高达双路CPU服务器5.77倍
Denotisia在美国圣克拉拉举行的AI Infrastructure Summit 2026上发布了搭载4张VDPU向量检索专用处理器卡的服务器方案。FPGA阶段评估结果显示,在相同软件栈条件下,该方案的向量检索吞吐最高可达双路CPU服务器的5.77倍,主机CPU和内存占用分别下降92%和73%。公司计划于今年第四季度启动基于ASIC的后续评估。
Industry
Qualcomm发布新一代Hexagon NPU:共享内存最高提升50%,面向智能体AI
Qualcomm披露了面向下一代高端移动平台的Hexagon NPU设计与性能数据,重点强化智能体AI场景下的端侧推理能力。新架构新增Transformer专用加速器,并将共享内存最高提升50%,以减少DDR访问并降低时延。公司称,在Int4模型基准下,预填阶段性能提升50%;在40亿参数模型上,首个Token生成时间低于1.5秒。
AI & Enterprise
Capsule Security发布基于NVIDIA Nemotron的AI代理行为防护系统
Capsule Security基于NVIDIA Nemotron微调两款模型,推出面向AI代理的行为防护系统。该系统作为外部控制层,可在代理执行动作前判断其是否符合既定任务,并实时作出放行、预警或拦截。公司称,该系统在StepShield基准测试中准确率达到98%,评测覆盖9429条代码代理执行路径,可用于降低敏感数据、源代码及基础设施访问带来的安全风险。
-
Games & Commerce
Unity发布Unity 6.6,强化开发效率与图形工作流
-
Games & Commerce
Kakao拟将AI深度整合进KakaoTalk:约半数请求由终端处理,服务器推理成本最高可降低90%
-
AI & Enterprise
Alibaba开源Qwen3.8-27B本地多模态模型,称性能可比肩Claude Opus 4.6 Max
-
AI & Enterprise
SK Telecom发布6880亿参数自研模型A.X K2,加快产业场景落地
-
AI & Enterprise
Kakao开源Kanana-2轻量级语言模型,可在手机等端侧设备运行
-
Games & Commerce
Unity发布Unity 7:引入与AI编程代理协同开发,覆盖开发到变现
-
Games & Commerce
Naver Labs Europe发布通用编码器DIVINE,统一机器人视觉AI模型
-
Games & Commerce
Windows 11“Xbox Mode”测试:内存占用更低,游戏帧率提升有限
-
AI & Enterprise
Agentic AI进入工程工作流,系统优先工程成可信落地关键
-
AI & Enterprise
Google发布Gemma 4 QAT:面向手机和笔记本降低端侧内存需求
-
AI & Enterprise
免费硬件监控工具HWiNFO用于NASA半导体辐射实验
-
AI & Enterprise
KAIST推出AI服务器“虚拟试验场”:无需先建昂贵硬件即可验证性能
-
AI & Enterprise
Prism ML发布Bonsai Image 4B:iPhone端侧出图约12秒
-
AI & Enterprise
DeepSeek凭借内存效率支撑低价策略 据悉正洽谈约700亿元人民币融资
-
AI & Enterprise
DeepSeek发布V4:主打高性能低成本,并适配华为Ascend