So sánh cho thấy cuộc đua AI không còn chỉ xoay quanh vị trí dẫn đầu về hiệu năng. Ảnh: Reve AI

Các mô hình trí tuệ nhân tạo của Trung Quốc đang rút ngắn nhanh khoảng cách về hiệu năng với nhóm dẫn đầu phương Tây, đồng thời kéo chi phí suy luận xuống thấp hơn tới 100 lần. Diễn biến này khiến trọng tâm cạnh tranh trên thị trường AI dần chuyển từ cuộc đua hiệu năng sang khả năng triển khai ở quy mô lớn với chi phí thấp.

Theo TechRadar ngày 28/7 (giờ địa phương), bên giành lợi thế trong cuộc đua AI có thể không phải là mô hình đơn lẻ mạnh nhất, mà là doanh nghiệp xây dựng được hệ sinh thái đủ sức đưa AI hiệu năng cao vào vận hành đại trà với chi phí hợp lý. Phân tích này so sánh 33 mô hình của 15 nhà cung cấp, dựa trên năng lực suy luận, chi phí vận hành và phương thức triển khai.

Trong bài kiểm tra GPQA Diamond, vốn đánh giá năng lực suy luận khoa học, các công ty Mỹ vẫn nắm lợi thế. Claude Mithos 5 của Anthropic đạt 94,4%, cao nhất trong nhóm khảo sát; tiếp theo là Google Gemini 3.1 Pro với 94,3% và Claude Fable 5 với 94,0%.

Dù vậy, khoảng cách đang thu hẹp đáng kể. Alibaba Qwen 3.7 Max đạt 92,4%, GLM-5.2 đạt 91,2% và DeepSeek V4 Pro đạt 90,1%, cho thấy các mô hình Trung Quốc đã tiến rất sát nhóm dẫn đầu.

Điểm khác biệt lớn nhất hiện nay không nằm ở hiệu năng, mà ở chi phí. Theo TechRadar, suy luận rẻ hơn không chỉ giúp doanh nghiệp thực hiện cùng một tác vụ với mức giá thấp hơn, mà còn mở rộng đáng kể phạm vi ứng dụng AI.

Khi có thể xử lý nhiều yêu cầu hơn với cùng ngân sách, doanh nghiệp không còn giới hạn AI ở một vài nghiệp vụ cốt lõi, mà có thể mở rộng sang chăm sóc khách hàng, tạo nội dung và tự động hóa công việc nội bộ. Điều này cũng mở ra cơ hội để startup và doanh nghiệp quy mô vừa triển khai AI ở cấp độ cao với chi phí tương đối thấp.

Vì vậy, thị trường đang có xu hướng phân hóa thành hai mảng. Ở phân khúc đại chúng như tư vấn khách hàng, soạn thảo tài liệu hay tạo nội dung, nơi chỉ cần hiệu năng đủ tốt, lợi thế về giá trở nên quan trọng hơn điểm benchmark.

Dữ liệu thực tế cũng phản ánh xu hướng này. Trong khoảng một năm qua, tỷ trọng các mô hình Mỹ trong lưu lượng trên nền tảng AI OpenRouter đã giảm từ khoảng 74% xuống quanh 20%, trong khi tỷ trọng mô hình Trung Quốc tăng lên gần một nửa. Theo TechRadar, nếu tính theo lượng token sử dụng, các mô hình Trung Quốc hiện đã chiếm ưu thế.

Ở chiều ngược lại, những mảng đòi hỏi suy luận phức tạp như lập trình hay AI agent vẫn duy trì giá trị cao đối với các mô hình có hiệu năng mạnh nhất.

Với các tác vụ cần xử lý nhiều bước liên tiếp, chỉ một chênh lệch nhỏ về hiệu năng cũng có thể tác động đáng kể đến kết quả cuối cùng. Vì thế, xu hướng doanh nghiệp dồn ngân sách AI vào những mô hình mạnh nhất vẫn chưa thay đổi. TechRadar cho biết Anthropic hiện chiếm khoảng 40% chi tiêu API của khối doanh nghiệp, chủ yếu nhờ nhu cầu liên quan đến lập trình và AI agent.

Một yếu tố khác giúp các công ty Trung Quốc mở rộng độ phủ là chiến lược cởi mở hơn trong triển khai mô hình. GLM-5.2, DeepSeek V4 Pro và Qwen 3.5 397B được cung cấp theo dạng open weight, cho phép doanh nghiệp tự vận hành trên máy chủ riêng. Cách tiếp cận này giúp tăng quyền kiểm soát dữ liệu, đồng thời giảm phụ thuộc vào chính sách giá hoặc thay đổi dịch vụ từ một nhà cung cấp AI cụ thể.

TechRadar đánh giá các công ty AI Trung Quốc không chỉ mang đến lựa chọn chi phí thấp hơn so với mô hình phương Tây, mà còn đưa ra một cách tiếp cận AI khác, dựa trên chi phí thấp, tính mở và quyền chủ động trong vận hành.

Tranh luận về chính sách quản lý AI vì thế cũng tiếp tục nóng lên. Gần đây, Satya Nadella, CEO Microsoft, Jensen Huang, CEO Nvidia, cùng nhiều lãnh đạo khác cho rằng việc siết quy định quá mức với các mô hình AI mở có thể làm suy yếu năng lực cạnh tranh của Mỹ. Trong thư ngỏ, họ nhấn mạnh việc mở rộng các mô hình AI dạng mở có thể giúp hạ chi phí công nghệ và thúc đẩy đổi mới trên toàn ngành.

Tuy nhiên, đà lan rộng của các mô hình AI Trung Quốc vẫn vấp phải giới hạn về mặt chính trị. TechRadar lưu ý rằng dù cởi mở về mặt kỹ thuật, một số mô hình Trung Quốc có thể hạn chế phản hồi hoặc thể hiện lập trường thiên lệch trong các câu hỏi liên quan đến sự kiện Thiên An Môn, vấn đề Đài Loan, Tân Cương Duy Ngô Nhĩ, biểu tình Hong Kong hoặc Chủ tịch Tập Cận Bình.

Công ty an ninh AI Enkrypt AI cũng cho biết trong quá trình phân tích DeepSeek R1, khoảng 91% câu hỏi nhạy cảm liên quan đến Trung Quốc vẫn nhận về các câu trả lời nghiêng theo hướng có lợi cho Trung Quốc. Điều đó cho thấy ngay cả khi doanh nghiệp tự vận hành mô hình trên máy chủ riêng, yếu tố thiên lệch chính trị cũng chưa chắc được loại bỏ hoàn toàn.

Theo TechRadar, các công ty AI phương Tây vẫn dẫn đầu về đỉnh hiệu năng, nhưng ngày càng khó duy trì mức giá cao trên toàn bộ thị trường. Ở phân khúc đại chúng, hiệu năng đủ tốt đi cùng chi phí thấp đang trở thành lợi thế cạnh tranh quan trọng hơn. Trong thời gian tới, kết quả của cuộc đua AI có thể sẽ được quyết định không chỉ bởi điểm benchmark, mà bởi bên nào xây được hệ sinh thái AI rẻ hơn và dễ mở rộng hơn.

Từ khóa

#trí tuệ nhân tạo #AI #chi phí suy luận #benchmark #Anthropic #Google #Alibaba #DeepSeek #OpenRouter #open weight
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.