搜索关键词 大语言模型推理
AI & Enterprise
Dinothicia开源STAR-KV技术,缓解大语言模型推理内存瓶颈
AI基础设施企业Dinothicia公开了KV缓存压缩技术STAR-KV的论文和源代码。论文实验显示,该方案仅凭低秩压缩即可将KV缓存最高减少75%;结合混合精度量化后,整体压缩幅度最高可达20倍,旨在缓解大语言模型长上下文推理中的内存和速度瓶颈。
AI & Enterprise
韩国三大运营商2025年研发强度排名:SK Telecom居首,KT快速逼近
韩国三大运营商2025年研发投入占营收比重分别为SK Telecom 2.08%、KT 1.26%、LG U+ 0.95%。尽管SK Telecom研发投入同比减少371亿韩元,但研发强度仍居首位;KT研发投入大幅增长至3553亿韩元,与SK Telecom的差距缩小至约5亿韩元。
AI & Enterprise
Qualcomm发布Snapdragon Wear Elite:3nm可穿戴旗舰芯片,CPU性能最高可提升5倍
Qualcomm在MWC 2026期间发布可穿戴旗舰芯片Snapdragon Wear Elite,首次将“Elite”品牌引入可穿戴产品线。该芯片采用3nm工艺,主打端侧AI和低功耗表现,CPU和GPU性能最高分别可提升5倍和7倍,并支持运行最高20亿参数大语言模型。随着平台发布,Samsung Electronics、Google等厂商的后续采用情况也受到市场关注。