搜索关键词 Token开销
AI & Enterprise
Alteryx CPO:企业优化AI成本应先控制算力和Token开销
Alteryx首席产品官Ben Canning表示,随着企业AI从试点走向规模化应用,模型调用成本正成为新的经营负担。仅靠模型路由或开源模型,难以从根本上解决成本问题。企业应先判断具体任务是否适合交给LLM处理,再通过业务逻辑层减少重复上下文输入和重复计算。
AI & Enterprise
Intel推出基于开源OPEA的企业混合AI平台“Superclaw”公测版,云端Token开销平均可降逾70%
Intel推出基于开源OPEA框架的企业级混合AI平台“Superclaw”公测版,通过本地与云端混合路由分配任务。文件解析、记忆检索和敏感数据脱敏等高频任务在本地完成,复杂多阶段推理和深度网页检索再交由云端大语言模型处理。Intel表示,该方案可使云端Token开销平均降低逾70%,从而减少调用Claude、ChatGPT等模型的成本。
Industry
NVIDIA发布机器人自我训练框架ENPIRE:8台双臂机器人4项任务实测成功率达99%
NVIDIA公布机器人学习框架ENPIRE,借助AI编码代理让真实机器人在无人干预情况下完成自我迭代。该系统已在GEAR Lab的8台双臂机器人上验证,4项真实环境任务成功率达到99%。不过,随着并行规模扩大,Token开销增长也快于训练时间缩短幅度。