图片来源:Snowflake

Snowflake于8月19日宣布,为旗下Cortex AI Gateway新增动态模型路由功能。

据介绍,企业客户启用“自动”选项后,无需预先固定使用单一模型,系统会根据具体任务在效果与成本之间进行权衡,自动选择更合适的模型。

Snowflake表示,在不少场景中,简单提问同样调用高性能模型,往往会带来不必要的成本支出和响应时延。公司内部测试显示,动态模型路由可使部分工作负载的Token成本最高降至原来的三分之一。

目前,Databricks、AWS、Google Cloud和NVIDIA也已推出相关模型路由方案。Snowflake认为,模型路由不仅关系到成本和性能,也与治理能力和上下文能力直接相关。

Snowflake AI业务副总裁Varis Gultekin表示,构建高质量的企业级智能体,需要完善的上下文能力和治理能力;上下文、可信度与模型选择彼此紧密相关。

Snowflake介绍称,动态模型路由主要有两种运行方式。其一为“顾问模式”:先由小模型尝试处理任务,若无法完成,再像调用工具一样切换至大模型接手处理。

另一种方式则是通过独立分类器学习历史查询数据,将简单问题自动分配给小模型。客户还可以将路由范围限定在指定模型或特定模型集合内。

在收费方面,Snowflake表示,动态模型路由功能本身不额外收费,仅按Token实际用量计费。

关键词

#Snowflake #Cortex AI Gateway #动态模型路由 #Token计费 #企业级AI #AI治理 #上下文能力 #AWS #Google Cloud #NVIDIA #Databricks
版权所有 © DigitalToday。未经授权禁止转载或传播。