一项最新研究指出,OpenAI与Anthropic月费约200美元的高端AI订阅服务,在特定高负载场景下,实际对应的API使用成本可能高达数千甚至上万美元。尤其是在代理式编程等高token消耗场景中,一旦重度用户将使用上限跑满,AI厂商所承担的成本压力也将显著上升。
据Cryptopolitan 24日报道,研究机构SemiAnalysis直接购买了OpenAI和Anthropic的高价订阅服务,并以长时间编程任务进行实测。结果显示,Anthropic相关服务单月折合API计费口径的使用成本约为8000美元,OpenAI则约为1.4万美元。
这一结果明显高于市场此前的普遍预期。过去,外界通常认为200美元月费订阅大致对应约2000美元的token使用量;但如果将使用额度充分用尽,折算后的API成本可能达到这一水平的3至7倍。
从产品设计来看,两家公司的高阶订阅套餐结构较为接近。Anthropic的Max套餐起价为100美元/月,提供相当于Claude Pro 5倍或20倍的使用额度。OpenAI方面,100美元/月套餐提供相当于Plus约5倍的使用量,200美元/月套餐则提升至约20倍。
不过,对普通用户而言,要实际消耗到上述水平并不容易。SemiAnalysis在测试中反复执行长时间编程任务,并尽量跑满每周使用上限进行测算。这也意味着,即便同样是200美元/月的订阅,不同使用方式下对应的实际API成本,以及AI厂商需要承担的边际成本,可能存在显著差异。
随着编程代理快速普及,token消耗也在明显上升。SemiAnalysis指出,与基础编程问答相比,代理式编程的token使用量可能高出约1000倍。即便处理的是同一项工作,不同方式之间的token消耗最高也可能相差30倍。不过,该机构同时表示,token投入更多并不必然意味着输出质量更高。
在降低成本方面,也有研究显示,若积极采用提示缓存(prompt caching),API成本可降至每100万token约0.57美元,降幅达到88.6%。但如果重度用户仅支付200美元月费,就消耗掉数千美元对应的API资源,AI厂商面临的成本压力仍然不可忽视。
与此同时,AI企业的业绩高速增长也让这一问题更加复杂。Anthropic第二季度营收超过116亿美元,同比增长逾一倍;OpenAI营收为67亿美元,同比增长18%。此外,Anthropic的年化营收运行率也已超过650亿美元。
但问题在于,使用量增长未必能直接转化为盈利改善。Ramp AI Index(8月)显示,在美国企业AI采用率方面,Anthropic为43.5%,OpenAI为39.7%。不过,Anthropic价格最高的模型Fable 5在推出首月,仅占客户购买全部token的6%。
未来,推理成本仍可能继续上升。Gartner预测,随着代理式AI持续扩散,到2028年,相关推理成本可能增至目前的5倍以上。即便token单价持续下行,若AI代理处理的token总量大幅增加,整体成本仍可能不降反升。
综合来看,OpenAI与Anthropic正面临一道现实选择题:是继续在高价订阅下维持较高使用上限并承担相应成本,还是调整使用条件。与此同时,具备价格竞争力的开源AI模型也在不断扩散,月费200美元的订阅模式能否成为可持续的盈利模式,正成为新的不确定因素。