Ngày 26/8, nhiều nguồn tin và phân tích kỹ thuật cho thấy Ox Alpha, mô hình AI viết mã xuất hiện ẩn danh trên OpenRouter, có thể do tổ chức AI Trung Quốc Z.ai phát triển.
Theo Cryptopolitan và một số nguồn tin quốc tế, Ox Alpha được đưa lên OpenRouter từ ngày 20/8 mà không gắn logo, tên công ty hay thông báo ra mắt riêng. Chỉ trong một tuần, mô hình này đã thu hút hàng triệu truy vấn từ cộng đồng lập trình viên.
Ox Alpha hỗ trợ ngữ cảnh lên tới 1.048.576 token, có thể xử lý văn bản, hình ảnh và video, đồng thời cho đầu ra tối đa 131.072 token. Mức này cao hơn đáng kể so với dải 8.000-200.000 token thường thấy ở nhiều mô hình phổ biến hiện nay.
Mô hình được cung cấp miễn phí. Cùng ngày, OpenCode, một công cụ agent terminal mã nguồn mở, cho biết sẽ tích hợp Ox Alpha và duy trì miễn phí trong một tuần, với lưu lượng xử lý ước tính 100 nghìn tỷ token mỗi ngày.
Theo thông tin trên OpenRouter, nhà cung cấp ẩn danh có lưu prompt và phản hồi nhưng không sử dụng các dữ liệu này để huấn luyện. Trong thời gian đó, các công cụ lập trình như Claude Code đã gửi mã doanh nghiệp lên mô hình với quy mô hàng tỷ token.
Kết quả đánh giá ban đầu cũng khiến Ox Alpha thu hút chú ý. Lập trình viên Ben Davis cho biết ở 10 bài kiểm tra thuộc benchmark DeepSWE, tỷ lệ thành công ở lượt chạy đầu tiên của Ox Alpha đạt 80%, cao hơn Claude Fable5 với 65% và GPT-5.6-Sol với 52%.
Dù vậy, Ben Davis lưu ý quy mô mẫu còn nhỏ, bởi chỉ cần chênh 1 bài trong 10 bài là kết quả có thể dao động 10 điểm phần trăm.
Khi mở rộng đánh giá ra toàn bộ 113 bài, kết quả của Ox Alpha ở mức khoảng 63%, tương đương GPT-5.6-Sol. Tuy nhiên, đến nay vẫn chưa có điểm số chính thức trên bảng xếp hạng sau quá trình kiểm chứng công khai.
Patrick Collison, CEO Stripe, cũng viết trên X rằng mô hình này “rất ấn tượng”. Trước đó, Stripe đã đạt thỏa thuận mua lại OpenRouter vào ngày 19/8.
Giới phát triển và các nhà nghiên cứu sau đó đã truy dấu nguồn gốc mô hình thông qua “dấu vân tay” tokenizer và phản hồi từ máy chủ. Nhà nghiên cứu Joseph W. Elstner cho biết sau khi đưa chuỗi thử nghiệm vào Ox Alpha rồi bổ sung bộ từ vựng GLM-5 do Z.ai công bố, toàn bộ 95 phép thử đều khớp hoàn toàn, với sai số trung bình bằng 0.
Trong một phân tích bằng công cụ “modelprint” do lập trình viên unclecode phát triển, 6 trong số 9 phép thăm dò hạ tầng cũng trùng khớp với dấu vết của GLM-5.3.
Nhà nghiên cứu Chetaslua cho biết khi gửi các yêu cầu gây lỗi, định dạng lỗi trả về giống với tài liệu API chính thức của Z.ai. Trong bài kiểm tra với giá trị role không hợp lệ, phản hồi lỗi cũng trùng với mô hình GLM của Z.ai.
Khi cùng bộ trọng số được triển khai trên một máy chủ khác, định dạng lỗi thay đổi. Chetaslua đánh giá mức độ tin cậy của suy luận này là 0,98.
Z.ai trước đây hoạt động dưới tên Zhipu AI. Trước đó, GLM-5 cũng từng được đưa lên OpenRouter dưới tên ẩn danh Pony Alpha, còn GLM-5.3 ra mắt ngày 14/8.