搜索关键词 低成本模型
AI & Enterprise
Google与OpenAI加速超高速AI竞赛:Gemini 3.7 Flash对阵GPT-5.6 Sol Ultrafast
Google正式推出面向代码生成和AI代理任务的低成本模型Gemini 3.7 Flash,并已在160多个国家上线。OpenAI同日发布GPT-5.6 Sol Ultrafast,为GPT-5.6 Sol新增超高速服务档位,称在Cerebras芯片支持下响应速度最高可提升14倍,输出速度最高可达每秒750个token。随着AI代理加速落地,行业竞争正从模型能力延伸至实时响应和交付效率。
AI & Enterprise
NVIDIA据报开发开源大模型Nemotron 4,参数规模或超1万亿
NVIDIA正加快推进自研开源大模型布局。根据The Information报道,公司正在开发参数规模至少1万亿的开源大语言模型Nemotron 4,并同步推出轻量化模型及免费模型路由软件。与此同时,NVIDIA还通过向云服务商回租AI服务器获取训练算力。公司认为,开源模型生态越丰富,越有望带动GPU需求增长;但市场也担心,随着NVIDIA更积极地推进自研模型,其与AI模型厂商之间的关系可能进一步复杂化。
AI & Enterprise
Uber、Microsoft收紧AI支出,按任务选模型成企业新趋势
随着AI支出持续攀升,越来越多企业开始加强成本管理,并采用“混用模型”策略:根据任务复杂度搭配不同模型,以降低对最新高价模型的依赖。Uber、Microsoft已开始重新审视员工AI开支;Coinbase首席执行官Brian Armstrong则预计,未来12至18个月内,80%的工作负载将转向成本更低的模型。
-
AI & Enterprise
Coinbase公开AI降本方法:调整默认模型、优化路由、提升缓存复用
-
AI & Enterprise
中国开源AI模型加速出海,全球竞争格局生变
-
AI & Enterprise
Microsoft拟将Copilot Cowork改为按量计费 评估引入DeepSeek等低成本模型
-
AI & Enterprise
企业AI成本攀升,大模型主导地位松动
-
AI & Enterprise
Coinbase CEO谈AI成本控制:高性能模型将只用于少数高推理任务
-
AI & Enterprise
美国企业压缩AI预算,模型路由加速落地
-
AI & Enterprise
低成本AI模型加速普及,OpenAI、Anthropic高估值IPO前景承压
-
AI & Enterprise
AI加密货币交易机器人遭遇“推理税”:Token成本侵蚀收益,散户两周左右即停用