中国多家AI机构推出的开源权重模型,正在开发者市场上快速扩大影响力。随着成本效率成为模型选型的重要指标,中国模型的使用量已开始反超美国闭源模型。
据媒体Cryptopolitan 18日(当地时间)报道,在面向开发者的模型聚合平台OpenRouter上,中国AI模型的周度token处理量已达到美国模型的3倍以上。
推动这一变化的核心因素是成本。OpenAI和Anthropic主要按token收费,向开发者提供闭源模型访问服务;而DeepSeek、Moonshot AI、Z.ai等中国AI公司则提供可下载、自行部署的开源权重模型。市场普遍认为,开发者在搭建和优化AI系统时,关注重点正从单纯追求性能,转向性能与成本并重。
平台使用数据也印证了这一趋势。到6月底,OpenRouter使用量排名前六的模型全部来自中国企业,涉及Tencent、Xiaomi、DeepSeek、MiniMax、Z.ai等厂商。
中国模型在用量上首次反超美国模型,出现在今年2月。2月9日至15日,中国模型在OpenRouter上处理了4.12万亿token,美国模型同期为2.94万亿token。相比2025年大部分时间里美国模型仍占据约70%的主要使用份额,市场格局已出现明显变化。
价格差距同样十分明显。根据Cryptopolitan披露,Z.ai旗下GLM 5.2的输入价格为每百万token 1.40美元,输出价格为每百万token 4.40美元;Anthropic的Opus 4.8对应价格分别为5美元和25美元。在性能接近的前提下,显著的成本差异正推动开发者转向中国开源权重模型。
类似趋势在其他平台上也有所体现。今年春季,中国开源权重模型在Hugging Face下载量中的占比达到41%,超过美国模型。Vercel发布的Production Index显示,开源权重模型占比已从4月的11%升至6月的29%。这些模型承担了约三分之一的token处理量,但相关成本占总支出的比例不足4%。
其中,DeepSeek在Vercel AI Gateway的token处理量中占比22.6%,仅次于Google,位居第二。
企业在AI部署上的成本压力,也在加速开源权重模型扩散。KPMG针对2145名企业高管的调查显示,29%的受访者表示,企业尚无法充分理解或有效控制AI运营成本。
从企业案例来看,Uber在今年4月之前就已用尽年度AI编程预算,随后将每名工程师的AI工具月度使用上限设定为1500美元。另有匿名企业被曝Anthropic Claude单月使用账单高达5亿美元。
不过,除成本优势外,安全与监管问题仍是企业采用中国模型时必须面对的难题。以Z.ai为例,其云端API受中国《国家情报法》约束。有观点认为,通过这类云端API传输的代码和数据,可能存在被中国监管部门获取的风险。美国国会也已于5月启动调查,关注关键基础设施采用中国AI模型可能带来的安全隐患。
与此同时,中国AI公司仍在继续强化开源权重战略。Moonshot AI正准备发布一款拥有2.8万亿参数的开源模型Kimi K3,并称其具备与美国顶级AI系统竞争的能力。
从测试结果来看,Kimi K3在综合基准测试中略低于Anthropic Claude Fable 5和OpenAI GPT-5.6 Sol,但在编程和AI Agent相关评估中,表现超过Claude Opus 4.8和GPT-5.5。
在定价方面,Kimi K3输入和输出价格分别为每百万token 3美元和15美元,低于GPT-5.6 Sol的5美元和30美元,也低于Claude Fable 5约10美元和50美元的水平。
业内普遍认为,在性能差距持续收窄的背景下,凭借成本效率和部署灵活性,中国开源权重模型的影响力仍有进一步扩大的空间。但对企业而言,在追求降本的同时,仍需同步评估数据控制、安全风险以及跨国监管带来的不确定性。