Nhà sáng lập DeepSeek, Liang Wenfeng, cho rằng sự phụ thuộc của ngành AI Trung Quốc vào phần cứng Nvidia có thể sớm giảm bớt. Theo ông, trong vòng một năm tới, nguồn cung chip sẽ không còn là trở ngại lớn đối với năng lực cạnh tranh của các công ty AI Trung Quốc.
Thông tin trên được Cryptopolitan đăng tải ngày 23/7 theo giờ địa phương, dẫn nội dung được cho là từ một cuộc gặp giữa Liang Wenfeng và nhà đầu tư. Tại đây, ông nói rằng “vấn đề nguồn cung sẽ không còn là trở ngại trong một năm”. Tuy nhiên, DeepSeek và cá nhân Liang Wenfeng hiện chưa xác nhận chính thức thông tin này.
Theo Liang Wenfeng, khác biệt lớn nhất giữa năng lực AI của Trung Quốc và Mỹ nằm ở nguồn lực. Ông cho rằng khoảng cách về nhân tài, hiệu năng mô hình và dịch vụ ứng dụng, xét cho cùng, đều bắt nguồn từ chênh lệch về tài nguyên tính toán.
Ông cũng giải thích rằng các doanh nghiệp Trung Quốc không thể tiếp cận đầy đủ những chip AI tiên tiến nhất của Nvidia do các biện pháp kiểm soát xuất khẩu từ Mỹ. Vì vậy, quy mô đầu tư vào AI cũng như dòng vốn dành cho đội ngũ nghiên cứu tại Trung Quốc vẫn thấp hơn Mỹ.
Liang Wenfeng thừa nhận Trung Quốc vẫn thua kém về quy mô mô hình. Theo ông, những mô hình AI tiên tiến nhất của phương Tây hiện sử dụng khoảng 800 tỷ tham số, trong khi các mô hình hàng đầu tại Trung Quốc mới dừng ở quy mô vài chục tỷ tham số.
Dù vậy, ông đánh giá DeepSeek hiện chỉ chậm hơn các công ty AI hàng đầu của Mỹ khoảng 12-18 tháng, nhưng có thể đạt hiệu năng tương đương với lượng tài nguyên tính toán chỉ bằng khoảng 1/20. Mục tiêu của công ty là rút ngắn khoảng cách này xuống còn 3-6 tháng.
Để tiến gần mục tiêu đó, DeepSeek được cho là đang mở rộng hợp tác với Huawei. Theo một số thông tin được lan truyền trên thị trường, công ty đã có trong tay khoảng 16.000 chip AI Ascend 950 của Huawei để tối ưu mô hình.
Liang Wenfeng cũng đánh giá “siêu nút Ascend 950” của Huawei có thể cạnh tranh với các hệ thống Nvidia GB200 và GB300 cả về hiệu năng lẫn giá thành.
Không chỉ dừng ở việc khai thác phần cứng sẵn có, DeepSeek còn được cho là đã tham gia phát triển chip AI riêng. Theo các nguồn tin am hiểu vấn đề, công ty đang thiết kế chip chuyên cho suy luận AI. Nếu được thương mại hóa, sản phẩm này có thể tạo ra thế cạnh tranh với cả Nvidia lẫn Huawei.
Ở mảng phần mềm, DeepSeek và giới nghiên cứu Trung Quốc cũng đang đẩy mạnh nỗ lực tự chủ bằng cách giảm lệ thuộc vào CUDA, nền tảng phát triển của Nvidia. Theo đó, họ phát triển một ngôn ngữ riêng mang tên “Tile Language”.
Liang Wenfeng dự báo trong vòng một năm tới, quan niệm phổ biến rằng chip AI do Trung Quốc phát triển “khó khai thác” cũng sẽ thay đổi đáng kể.
Trên thị trường bán dẫn AI Trung Quốc, các dấu hiệu dịch chuyển đã bắt đầu xuất hiện. Thị phần của Nvidia trong phân khúc bộ tăng tốc AI tại nước này được cho là đang thu hẹp, trong khi các nhà sản xuất chip AI nội địa đã chiếm 41% thị phần trong năm ngoái và xuất xưởng khoảng 1,65 triệu card tăng tốc AI.
Alibaba cũng đã đưa vào triển khai trên quy mô lớn bộ xử lý AI tự phát triển mang tên “Zhenyu”, đồng thời công bố mã nguồn mở cho phần mềm liên quan. Trong khi đó, Huawei và Moore Threads đang xây dựng hệ sinh thái phần mềm nhằm thay thế CUDA của Nvidia.
Song song với nỗ lực của doanh nghiệp, chính phủ Trung Quốc cũng đang tích cực hỗ trợ phát triển chip AI nội địa và hệ sinh thái phần mềm, nhằm ứng phó với các biện pháp hạn chế xuất khẩu công nghệ AI từ Mỹ.
Trong bối cảnh đó, Huawei gần đây đã công bố “Atlas 950 Superpod” tại Hội nghị AI Thế giới ở Thượng Hải. Hệ thống này kết nối 8.192 chip Ascend, và Huawei khẳng định hiệu năng tính toán của nó cao hơn tối đa 6,7 lần so với Nvidia NVL144, đồng thời được xây dựng mà không sử dụng linh kiện sản xuất tại Mỹ.
Giới quan sát nhận định các doanh nghiệp AI Trung Quốc đang tăng tốc xây dựng hạ tầng AI tự chủ dựa trên hệ sinh thái bán dẫn và phần mềm riêng. Vấn đề thị trường theo dõi lúc này là liệu những nỗ lực đó có thể chuyển hóa thành năng lực cạnh tranh thương mại thực sự hay không.