搜索关键词 Gemma 4
AI & Enterprise
Red Hat发布Red Hat AI 3.5,聚焦上线前安全验证、共享GPU多租户与可观测性
Red Hat发布企业AI平台Red Hat AI 3.5,重点强化上线前安全验证、共享GPU环境下的多租户管理和可观测性能力,并进一步完善智能体开发支持。新版本推出EvalHub,可对模型、RAG配置和智能体进行部署前校验,并生成可审计的合规报告和合规认证证书;同时新增20余款已验证模型,增强GPU调度和分布式推理支持。
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
NVIDIA宣布,面向AI代理的推理加速器Groq 3 LPX已进入量产,并在Hot Chips 2026上正式亮相。该方案可与Vera Rubin NVL72配合,将长上下文处理与解码环节拆分。在Artificial Analysis基准测试中,Groq 3 LPX在10万token上下文窗口下运行Gemma 4 31B时,生成速度最高达到每秒3400个token。Nebius Group等企业将率先部署这一方案。
Industry
NVIDIA在Hot Chips 2026发布多项新品,瞄准AI推理Token生成速度
在Hot Chips 2026大会上,NVIDIA赶在二季度财报发布前推出多款面向AI推理和网络基础设施的新产品,包括启动量产的Grok 3 LPX、以太网扩展方案Spectrum-X Multiplane以及基础设施加速方案ScaleIn。公司同时披露,Vera CPU已被SpaceXAI采用;整体布局聚焦AI推理阶段的Token生成速度、网络扩展能力以及面向AI智能体的计算架构。
-
AI & Enterprise
Google发布Gemma 4 QAT:面向手机和笔记本降低端侧内存需求
-
AI & Enterprise
NVIDIA发布5500亿参数开源大模型Nemotron 3 Ultra,Vera Rubin平台进入量产阶段
-
AI & Enterprise
实测显示:借助GitHub工具数分钟内可移除Meta、Google开放权重模型安全护栏
-
AI & Enterprise
Google DeepMind发布Gemma 4,性能升级并转向Apache 2.0开源许可
-
AI & Enterprise
LG AI Research推出多模态大模型EXAONE 4.5,聚焦复杂文档理解与推理
-
AI & Enterprise
Google面向iPhone推出Google AI Edge Eloquent:支持离线转写并实时整理口语
-
AI & Enterprise
软件企业重构AI定价:从按用量转向按成果收费
-
AI & Enterprise
Google发布Gemma 4开放权重模型,可在低功耗设备端本地运行复杂推理