搜索关键词 Gemma
AI & Enterprise
Red Hat发布Red Hat AI 3.5,聚焦上线前安全验证、共享GPU多租户与可观测性
Red Hat发布企业AI平台Red Hat AI 3.5,重点强化上线前安全验证、共享GPU环境下的多租户管理和可观测性能力,并进一步完善智能体开发支持。新版本推出EvalHub,可对模型、RAG配置和智能体进行部署前校验,并生成可审计的合规报告和合规认证证书;同时新增20余款已验证模型,增强GPU调度和分布式推理支持。
AI & Enterprise
Perplexity Mac版推出“混合计算” 敏感信息留在本地处理
Perplexity推出面向Mac版应用的“混合计算”功能,可将同一任务拆分后交由云端模型和本地模型分别处理,敏感信息相关处理可留在设备端完成,以兼顾隐私保护与推理成本控制。系统支持自动识别敏感内容,并提示用户确认是否上传至云端。目前该功能仅支持运行macOS 15的Apple Silicon Mac,官方建议设备至少配备32GB统一内存。
AI & Enterprise
Rabbleup研究员:智能体普及将推动多模型协同,小型模型使用占比上升
Rabbleup研究员Lee Junbeom表示,在生成式AI服务中,不同规模模型分工协作已成为常态。检索、信息收集、摘要等任务通常由小型模型完成,关键判断和内容生成则由前沿大模型负责。随着智能体应用加快普及,模型调用频率持续上升,推理成本压力也随之加大,多模型协同和小型模型的应用比重预计将进一步提高。
-
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
-
Industry
NVIDIA在Hot Chips 2026发布多项新品,瞄准AI推理Token生成速度
-
AI & Enterprise
Kakao发布Kanana-2安全评估结果:综合评分高于Gemma和Qwen
-
AI & Enterprise
中国AI企业免费开放开源权重模型,冲击美国闭源AI格局
-
AI & Enterprise
Kakao开源Kanana-2轻量级语言模型,可在手机等端侧设备运行
-
AI & Enterprise
DeepSeek开源DSpark:推理提速最高85%,吞吐量最高提升661%
-
Industry
Hanwha Power首次切入美国燃气联合循环电站市场,随950MW项目投产实现参与
-
AI & Enterprise
KT发布多模态AI安全评测基准KSAFE-MM,聚焦韩语及韩国文化语境
-
AI & Enterprise
Google发布Gemma 4 QAT:面向手机和笔记本降低端侧内存需求
-
AI & Enterprise
NVIDIA发布5500亿参数开源大模型Nemotron 3 Ultra,Vera Rubin平台进入量产阶段
-
AI & Enterprise
实测显示:借助GitHub工具数分钟内可移除Meta、Google开放权重模型安全护栏
-
AI & Enterprise
Selectstar“StarTeaming”论文入选ACL 2026
-
AI & Enterprise
Nebius拟斥资6.43亿美元收购Eigen AI,补强推理与模型优化能力
-
AI & Enterprise
Google DeepMind发布Gemma 4,性能升级并转向Apache 2.0开源许可
-
AI & Enterprise
LG AI Research推出多模态大模型EXAONE 4.5,聚焦复杂文档理解与推理