搜索关键词 计算效率
AI & Enterprise
Kakao将在ECCV 2026公开KATok:视频生成模型训练速度提升约6.9倍
Kakao将于ECCV 2026公开自适应视频Token化技术KATok。该技术可根据视频的时空复杂度自动调整Token数量,减少冗余计算。实验显示,相比Dense Tokenizer方案,相关视频生成模型训练速度提升约6.9倍,生成速度提升约3.2倍。公司还计划将其进一步拓展至更高分辨率和长视频场景。
AI & Enterprise
Nota完成Kimi K3轻量化优化,GPU需求最高降低50%
AI模型轻量化与优化企业Nota宣布,已完成对Moonshot AI开源模型Kimi K3的轻量化优化。公司通过自研“非均匀专家剪枝”技术,在保留核心专家的同时裁剪低贡献模块,使模型所需NVIDIA B300 GPU由8块降至6块或4块,需求最高可降低50%。
AI & Enterprise
Cohere加码主权AI,年内拟推1万亿参数大模型
企业级AI公司Cohere表示,将在不替代客户现有系统的前提下,以更低成本提供企业AI方案。公司强调,自创立之初便将主权AI作为核心方向,并透露已在韩国、日本设立本地法人,亚太地区技术与销售团队计划在今年年底前扩大至目前的两倍。与此同时,Cohere还计划年内推出1万亿参数的新模型Command A+。
-
Industry
Rebellions称单台自研NPU服务器可提供接近高性能GPU服务器的AI基础设施能力
-
AI & Enterprise
Unconventional AI发布振荡器计算架构,瞄准将AI推理功耗降至现有系统水平的千分之一
-
AI & Enterprise
Broadcom数日蒸发超4400亿美元市值,引发AI芯片板块估值忧虑
-
AI & Enterprise
日本将作为首个海外伙伴参与美国AI项目“Genesis Mission”,未来5年计划共投10亿美元
-
Mobility
BYD发布自研4nm智驾芯片Xuanji A3:可支持L3、L4级自动驾驶
-
AI & Enterprise
KAIST研发硅基振荡器 Ising 机器硬件 面向组合优化求解
-
AI & Enterprise
Google Research发布TurboQuant:AI模型内存占用最低可降至原来的1/6
-
AI & Enterprise
内存紧缺催热CXL,Google已在数据中心导入
-
Column
AI与无线技术持续升级:工程工作流、混合网络和嵌入式系统加速重构
-
AI & Enterprise
Microsoft发布第二代AI芯片Maia 200,加码云端AI算力布局
-
AI & Enterprise
Kakao升级开源语言模型Kanana-2,新增4款模型强化Agent AI能力
-
AI & Enterprise
QAI签约SDT采购20量子比特超导量子计算机,推出商用量子-AI混合计算服务
-
AI & Enterprise
NVIDIA公布Vera Rubin:训练所需规模降至Blackwell四分之一