搜索关键词 300亿参数
Industry
Qualcomm称手机端可运行300亿参数模型:智能体越强,对大模型依赖越高
Qualcomm在Snapdragon Summit 2026上展示了其端侧AI新架构。通过让数据尽量贴近计算单元,新一代Snapdragon 8 Elite第六代可在智能手机上运行300亿参数模型,并将更多上下文和KV缓存保留在NPU内部,以降低时延。公司同时结合MoE架构与UFS 5.0闪存,支持模型按需从闪存加载运行,并称部分模型的Prefill阶段性能最高提升80%。
AI & Enterprise
可在PC本地运行的大模型升温 DeepSeek、Meta、NVIDIA加码轻量化竞争
随着AI投入不断增加,越来越多企业开始以高性价比开源模型承接基础任务,可在个人PC本地运行的大模型热度随之攀升。DeepSeek于7月底发布V4 Flash,主打性能与成本优势;Meta计划推出强调隐私和本地AI代理能力的Muse Glimmer;NVIDIA也上线开源模型Nemotron 3.5 Lightning,本地模型生态竞争进一步升温。
AI & Enterprise
Meta重回开源:将开放Muse Spark 1.2模型权重
在一度转向闭源之后,Meta再次加大开源布局,宣布将开放旗舰模型Muse Spark 1.2的权重,并计划推出面向消费级设备的新模型系列Muse Glimmer。该系列模型拥有300亿参数,可在Mac或PC上仅凭单张消费级GPU完成多步骤AI代理任务。