搜索关键词 token预算
AI & Enterprise
数据库厂商加码数据层,帮助AI代理压降Token开销
随着AI企业由包月模式转向按量计费,AI代理的运营成本持续攀升。Pinecone推出知识引擎Nexus,通过预先梳理数据结构和沉淀可复用上下文,减少重复检索带来的Token消耗;TigerData则发布Ghost,可为每个代理快速创建独立的PostgreSQL数据库,并按实际计算时间收费。
Industry
NVIDIA发布机器人自我训练框架ENPIRE:8台双臂机器人4项任务实测成功率达99%
NVIDIA公布机器人学习框架ENPIRE,借助AI编码代理让真实机器人在无人干预情况下完成自我迭代。该系统已在GEAR Lab的8台双臂机器人上验证,4项真实环境任务成功率达到99%。不过,随着并行规模扩大,Token开销增长也快于训练时间缩短幅度。
AI & Enterprise
Token成本走高,企业级PC成AI本地推理新抓手
随着云端成本持续上升、企业对数据自主可控的关注增强,AI推理部署方式正被重新评估。Dell表示,Agentic AI会带来多轮模型调用,推高云端API的Token成本;在这一背景下,AI PC和企业级PC作为本地推理终端受到更多关注,可帮助企业更精细地管理预算,并将敏感数据保留在设备端处理。