搜索关键词 推理性能
AI & Enterprise
NVIDIA按OpenMDW-1.1许可开放Alpamayo 2 Super商用,瞄准Robotaxi与自动驾驶量产部署
NVIDIA宣布,面向Robotaxi和自动驾驶开发的推理模型Alpamayo 2 Super正式开放商用。该模型具备开放商用许可、领先的推理性能,以及可审查、可验证的决策过程,目标指向自动驾驶车辆的量产与规模化部署。按照OpenMDW-1.1许可,开发者还可在Hugging Face获取模型,并进行微调、二次开发和商业再分发。
AI & Enterprise
SK Telecom与MIT联合研究TTT技术 提升自研基础模型推理效率
SK Telecom表示,公司正与美国麻省理工学院(MIT)开展联合研究,开发提升自研AI基础模型推理性能和算力效率的技术。双方研究的核心是“推理时训练”(TTT),即让模型在回答特定问题前结合相关资料进行短时追加学习。MIT教授 Kim Yoon-hyung 表示,“主权AI”的竞争力关键在于人才储备以及大规模系统的实际开发和运营经验,同时也应警惕因过度强调“主权”而引发不必要的竞争。
AI & Enterprise
OpenAI用GPT-5.6优化自身推理基础设施,端到端服务成本降20%
OpenAI表示,已利用最新模型GPT-5.6优化自家推理引擎和GPU任务分配(资源调度)。其中,高性能版本GPT-5.6 Sol的端到端服务成本下降20%,Token生成效率提升15%。相关优化覆盖推理内核、投机式解码、KV缓存、任务分配及工具调用策略,在相同硬件条件下可承载更多请求。
-
Industry
Mobilint将亮相ISEC 2026 展示NPU安防方案与实时视频分析能力
-
AI & Enterprise
Anthropic与AMD达成数十亿美元合作 锁定最高2GW的GPU容量
-
AI & Enterprise
Nota推出适配AWS自研AI芯片的模型优化服务
-
Industry
FuriosaAI与Broadcom合作开发第三代AI加速器
-
AI & Enterprise
Token成本走高,企业级PC成AI本地推理新抓手
-
Industry
Mobilint两款NPU产品入选韩国采购署创新产品,切入公共AI基础设施市场
-
AI & Enterprise
MegazoneCloud获选韩国政府AI半导体海外实证项目牵头企业
-
AI & Enterprise
Google Cloud CEO:未来一两年AI市场将加速洗牌,经济性决定企业生存
-
Mobility
特斯拉酝酿推出HW4 Plus:系统内存翻倍至64GB
-
AI & Enterprise
DeepSeek洽谈首轮外部融资,估值或超200亿美元
-
Industry
NVIDIA:AI芯片竞争转向端到端效率,Blackwell在MoE推理中较上一代Hopper快55倍
-
Industry
MLPerf推理v6.0发布:数据中心AI推理芯片竞争加剧
-
AI & Enterprise
Gimlet Labs完成8000万美元A轮融资,发力“多芯片推理云”
-
Industry
NVIDIA在GTC 2026发布Vera Rubin并公布Groq 3 LPX,AI加速迈向制造、出行与医疗场景
-
Industry
Jensen Huang到访GTC 2026 Samsung Electronics展台,并为HBM4与Groq晶圆签名