搜索关键词 Token消耗
AI & Enterprise
Thinking Machines Lab发布Inkling:开放权重,主打企业定制AI
由Mira Murati领衔的Thinking Machines Lab发布首款自研开放权重模型Inkling。该模型采用MoE架构,总参数量达9750亿,单次推理实际激活约410亿参数,基于45万亿token的多模态数据训练。公司同时推出“tinker”平台,面向企业提供增量训练、微调和托管能力。
AI & Enterprise
OpenAI发布GPT-5.6提示新指南:弱化长指令,强调“结果优先”
OpenAI发布面向GPT-5.6的新版提示指南,核心思路是以更简洁的指令明确目标、完成标准和中止条件,把执行路径更多交由模型自主处理。OpenAI披露的内部编程代理测试显示,缩短系统提示后,评测成绩提升约10%至15%,Token用量减少41%至66%,成本下降33%至67%。
AI & Enterprise
Anthropic旗下Claude Code首轮请求最高达7.5万至8.5万Token,未提问先占用大量上下文
AI咨询公司Systima对Claude Code与开源工具OpenCode进行对比测试后发现,Claude Code在用户发出指令前就会先向模型发送大量Token。最简场景下,首轮请求约为32800 Token;在真实开发环境中,则可能升至7.5万至8.5万Token。造成差异的主要因素包括工具说明、系统提示词、指示文件以及MCP服务器配置,这不仅会增加调用成本,也会提前占用上下文窗口容量。
-
AI & Enterprise
Datadog:企业AI、IT与安全治理需纳入统一平台,强化自运维与防护能力
-
AI & Enterprise
OpenAI发布GPT-5.6 Sol:每百万token输入/输出5/30美元,性能跻身第一梯队
-
AI & Enterprise
KT布局“Token Factory”,发力AI Token管理与结算新业务
-
AI & Enterprise
Uber、Microsoft收紧AI支出,按任务选模型成企业新趋势
-
AI & Enterprise
Palantir CEO抨击Anthropic和OpenAI的Token计费模式:企业可转向开源权重模型
-
Finance
AI计费转向按Token收费,银行业成本管控成新课题
-
AI & Enterprise
Coinbase公开AI降本方法:调整默认模型、优化路由、提升缓存复用
-
AI & Enterprise
OpenAI小范围推出GPT-5.6三款模型:Sol、Terra、Luna,Sol聚焦网络安全
-
AI & Enterprise
企业AI加速降本:模型路由、开源定制与用量管控成主流手段
-
AI & Enterprise
Google将Gemini 3.5 Pro发布时间推迟至7月
-
AI & Enterprise
数据库厂商加码数据层,帮助AI代理压降Token开销
-
AI & Enterprise
企业AI成本管控趋严:Amazon、Walmart收紧使用限制,OpenAI与Anthropic加码韩国市场布局
-
AI & Enterprise
AI成本攀升,Amazon、Walmart、Meta等开始收紧员工使用额度
-
AI & Enterprise
KAIST推出一体化数据库系统,企业AI代理回答准确率最高提升78%
-
AI & Enterprise
Coinbase CEO谈AI成本控制:高性能模型将只用于少数高推理任务