搜索关键词 小模型
AI & Enterprise
Z.ai创始人Jie Tang:不能只盯参数量,推理成本正在重塑AI模型Scaling Law
清华大学教授、Z.ai创始人Jie Tang表示,衡量AI模型性能不能只看参数规模,还需同时考虑数据量、算力分配及实际运行方式。随着模型调用频次持续攀升,生命周期总成本的重心正从训练转向推理,这也使“更小模型、训练更久”成为更具吸引力的路线。Jie Tang还指出,MoE架构下,Chinchilla提出的“20:1”配比已不再普适;Z.ai最新公开的GLM-5.3也显示,仅在后训练阶段加码,仍能带来明确提升。
AI & Enterprise
Swimlane推出SOC智能路由功能:告警可自动分流至自动化或AI调查
Swimlane面向安全运营中心(SOC)推出智能路由功能,可对进入系统的告警自动分类,并分配至确定性自动化、AI调查或Agentic自动化等不同处置路径。该功能会先判断告警复杂度及所需AI介入程度,再调用相应模型处理,以在提升安全调查效率的同时控制AI使用成本。
AI & Enterprise
Snowflake为Cortex AI Gateway新增动态模型路由,部分负载成本最高降至原来三分之一
Snowflake宣布为Cortex AI Gateway推出动态模型路由功能。企业客户启用“自动”模式后,无需预先固定单一模型,系统将根据具体任务在效果与成本之间进行权衡并自动完成选择,以减少简单请求调用高性能模型带来的额外开销。Snowflake称,内部测试显示,部分工作负载的Token成本最高可降至原来的三分之一,路由功能本身不单独收费。
-
AI & Enterprise
OpenAI与Anthropic或收紧高端模型API开放
-
AI & Enterprise
Hugging Face数据:点赞榜与下载榜明显分化,开发者更青睐小模型
-
AI & Enterprise
LG AI研究院:K-EXAONE通过韩国“独立AI基础模型项目”第二阶段评估
-
Industry
Dinotisia加入Kolon Benit AI联盟,加快行业定制化AI应用落地
-
AI & Enterprise
本地部署小模型加速升温,韩国“独立AI基础模型”二轮评估结果将出炉
-
AI & Enterprise
Alibaba开源Qwen3.8-27B本地多模态模型,称性能可比肩Claude Opus 4.6 Max
-
AI & Enterprise
AI模型需求转向“够用型”,顶级模型回本压力加大
-
AI & Enterprise
NVIDIA加码开源大模型,Nemotron 4参数规模或超1万亿
-
AI & Enterprise
Zhang Yiming:ByteDance自研AI模型训练不采用“蒸馏”
-
AI & Enterprise
WSJ:美国开放权重AI初创公司兴起,能否撼动中国优势仍待观察
-
AI & Enterprise
WSJ:AI加速商品化,OpenAI与Anthropic护城河减弱
-
AI & Enterprise
Moonshot AI发布Kimi K3:中国前沿模型与美国头部模型差距缩至“按周计算”
-
AI & Enterprise
PrismML称已在iPhone 17 Pro上运行270亿参数大模型
-
Games & Commerce
Naver详解“AI标签”核心技术:从回答走向执行
-
AI & Enterprise
Qualcomm发布HBC架构,计划于2027年中推出AI250推理加速器