外媒报道称,匿名编程模型 Ox Alpha 的开发方已被指向中国 AI 研究机构 Z.ai。
据 Cryptopolitan 等外媒 26 日报道(以下均为当地时间),Ox Alpha 于 20 日上线 OpenRouter,页面未显示 logo、公司名称,也没有任何配套说明。上线一周内,该模型获得了数百万次开发者调用。
从参数规格看,Ox Alpha 支持最高 1,048,576 token 的上下文窗口,可处理文本、图片和视频,最大输出为 131,072 token。相较多数模型通常仅支持 8,000 至 200,000 token 的上下文范围,Ox Alpha 的上下文容量明显更高。
该模型上线初期曾免费开放。开源终端代理 OpenCode 当天接入 Ox Alpha,并表示将免费维持一周,同时披露其日处理容量达到 100 万亿 token。OpenRouter 页面则注明,匿名提供方会保存提示词和回复内容,但不会将其用于训练。在此期间,包括 Claude Code 在内的编程工具曾向该模型发送规模达数十亿 token 的企业代码。
Ox Alpha 也因早期测试成绩受到关注。开发者 Ben Davis 表示,在 DeepSWE 基准测试的 10 个任务中,Ox Alpha 的首轮尝试准确率达到 80%,高于 Claude Fable5 的 65% 和 GPT-5.6-Sol 的 52%。不过他也指出,由于样本量仅有 10 个任务,单个任务的差异就可能带来 10 个百分点的波动。
在测试范围扩大到全部 113 个任务后,Ox Alpha 的得分约为 63%,与 GPT-5.6-Sol 接近。不过,截至目前,仍未出现经公开验证的官方榜单成绩。Stripe CEO Patrick Collison 也曾在 X(原 Twitter)上评价称,该模型“非常令人印象深刻”。值得注意的是,Stripe 已于 19 日同意收购 OpenRouter。
随着关注升温,开发者和研究人员开始通过分词器指纹、服务器响应和基础设施探针等方式追踪其来源。研究人员 Joseph W. Elstner 表示,在向 Ox Alpha 输入测试字符串后,再与 Z.ai 公布的 GLM-5 词表进行比对,95 个探针全部匹配,平均误差为 0。开发者 unclecode 制作的“modelprint”分析结果也显示,在 9 个基础设施探针中,有 6 个与 GLM-5.3 相对应。
研究人员 Chetaslua 进一步指出,向 Ox Alpha 发送异常请求后返回的报错格式,与 Z.ai 官方 API 文档中的格式一致;在测试非法 role 值时,也出现了与 Z.ai 的 GLM 模型相同的报错信息。他表示,即便部署相同权重,只要更换主机,报错格式也会发生变化,并将这一推断的可信度评为 0.98。
Z.ai 过去曾以“Zhipu AI”这一名称对外运营。此前,GLM-5 也曾以“Pony Alpha”之名在 OpenRouter 上匿名发布;GLM-5.3 则于本月 14 日推出。