搜索关键词 TurboQuant
AI & Enterprise
Dinothicia开源STAR-KV技术,缓解大语言模型推理内存瓶颈
AI基础设施企业Dinothicia公开了KV缓存压缩技术STAR-KV的论文和源代码。论文实验显示,该方案仅凭低秩压缩即可将KV缓存最高减少75%;结合混合精度量化后,整体压缩幅度最高可达20倍,旨在缓解大语言模型长上下文推理中的内存和速度瓶颈。
Industry
AI“代币需求”争议升温,内存订单前景仍存不确定性
AI“代币需求”能否真正转化为可验证的经济产出,正成为DRAM和HBM景气判断的关键变量。Computex 2026期间,多家企业和机构预计到2030年相关需求将较当前增长约40倍,但业内认为,宏观指标尚未反映相应产出变化,加之技术效率提升可能重塑内存需求结构,订单能见度目前仍更多取决于客户预期。
Industry
AI推理带动冷数据激增,HDD交付周期拉长推高QLC SSD需求
随着AI推理加速落地,对话记录、上下文等冷数据存储需求快速上升。HDD交付周期延长、NAND供给偏紧,正推动具备大容量、低成本优势的QLC SSD加快渗透。按工作日口径计算,4月SSD出口日均金额同比增长717%至1.7亿美元。在价格上涨与扩产节奏偏慢的背景下,存储需求结构与供应链格局正在重塑。
-
Industry
CNBC:HBM热潮推高内存股,美韩股市受提振之际周期风险仍需警惕
-
People & Appointments
韩国科学技术信息通信部第二副部长Lyu Je-myeong与AI、ICT青年人才举行座谈会
-
Industry
DDR4内存价格近一年来首次下跌:16GB DRAM现货价一个月跌约5%
-
Industry
多地渠道PC内存价格现松动迹象,DDR4、DDR5仍处高位
-
Industry
Samsung Electronics、SK hynix一季度业绩料超预期 行业景气仍存隐忧
-
AI & Enterprise
Google推出TurboQuant:向量搜索索引生成时间接近归零,或重塑搜索体验
-
Finance
中东局势与半导体担忧压制KOSPI,本周关注美伊谈判与经济数据
-
AI & Enterprise
Google Research发布TurboQuant:AI模型内存占用最低可降至原来的1/6
-
Industry
Google推出TurboQuant压缩KV缓存,SK hynix、Samsung Electronics等存储股走低
-
Finance
外资连续6个交易日净卖出韩股现货,周内累计净卖出首次超10.1万亿韩元
-
AI & Enterprise
Google发布TurboQuant:大语言模型(LLM)内存占用可降至1/6,速度最高提升8倍