DeepSeek, startup trí tuệ nhân tạo của Trung Quốc, ngày 31/7 theo giờ địa phương đã ra mắt V4 Flash, mô hình lập trình mới tập trung vào hiệu quả chi phí.
Theo Axios ngày 1/8, V4 Flash đạt kết quả gần với Claude Opus 4.8 của Anthropic trong các bài kiểm tra lập trình phức tạp và tác vụ phần mềm tự động. Trên bảng xếp hạng Arena Frontend Coding, mô hình của DeepSeek thậm chí vượt Claude Opus 4.8 và được xem là một trong những mô hình có tương quan hiệu năng/chi phí tốt nhất trong cùng phân khúc.
Trong khi Claude Opus 4.8 có giá 25 USD cho mỗi phút đầu ra, DeepSeek chào giá V4 Flash ở mức khoảng 28 cent, thấp hơn tới 99%.
Axios nhận định, khi các mô hình AI Trung Quốc như Kimi K3 ngày càng gây sức ép lên thị trường Mỹ, cuộc cạnh tranh giá trên thị trường AI đã tăng nhiệt từ tháng 7.
OpenAI cũng đã giảm tới 80% giá của mô hình giá rẻ GPT-5.6 Luna chỉ sau ba tuần ra mắt. Google bổ sung thêm ba biến thể Gemini “Flash” tập trung vào hiệu quả, còn Meta tung ra mô hình đóng dành cho nhà phát triển với chính sách giá quyết liệt.
Với Anthropic, Axios cho biết công ty này vẫn giữ nguyên mức giá của các mẫu Claude cao cấp, đặt cược rằng cộng đồng phát triển sẽ sẵn sàng trả thêm để đổi lấy độ an toàn và độ chính xác.
Axios đánh giá V4 Flash là ví dụ cho thấy ngay cả những phần mềm AI tiên tiến nhất cũng đang nhanh chóng mang tính hàng hóa.
Khi một sản phẩm trở thành hàng hóa, giống như thiết bị điện tử hay xăng dầu, người mua sẽ quan tâm nhiều hơn đến giá bán thay vì nhà sản xuất. Theo Axios, khi khoảng cách hiệu năng giữa các mô hình cao cấp ngày càng thu hẹp, các ứng dụng AI cũng bớt phụ thuộc vào một nhà cung cấp duy nhất, đồng thời người mua có thêm dư địa để lựa chọn theo mức giá.
Bài viết cũng đề cập triển vọng tăng lên của các “router thông minh”, có thể tự động chọn mô hình tối ưu dựa trên hiệu năng, tốc độ và chi phí. Điều đó đồng nghĩa ngay cả khi doanh nghiệp chi hàng chục tỷ USD để phát triển mô hình tốt hơn, lợi thế này có thể chỉ mang tính tạm thời và chưa chắc chuyển hóa thành quyền lực định giá bền vững.
Ở chiều ngược lại, AI giá rẻ có thể kích thích nhu cầu sử dụng tăng mạnh hơn. OpenAI cũng kỳ vọng có thể bù đắp biên lợi nhuận mỏng bằng quy mô sử dụng vượt trội. Axios cho rằng trong bối cảnh Mỹ và Trung Quốc cùng chạy đua để hạ chi phí “trí tuệ”, câu hỏi then chốt là liệu cuộc đua đó có thực sự chuyển thành lợi nhuận hay không.