DeepSeek đang đặt ưu tiên hàng đầu vào việc huấn luyện mô hình trí tuệ nhân tạo bằng chip nội địa, đồng thời kỳ vọng Huawei có thể bắt đầu cung ứng chip phục vụ huấn luyện từ quý IV năm nay. Công ty cũng đã lên kế hoạch phát triển mô hình AI quy mô 8 nghìn tỷ tham số.
Theo The Information, tại một cuộc họp kín với nhà đầu tư, CEO DeepSeek Liang Wenfeng cho biết mục tiêu ưu tiên số một của công ty là huấn luyện AI bằng chip nội địa.
Ông đánh giá việc huấn luyện mô hình bằng chip nội địa, trong đó có chip của Huawei, là một trong những bước đi mạo hiểm nhất của DeepSeek và nhấn mạnh đây là nhiệm vụ “nhất định phải thành công”.
DeepSeek dự kiến nhận chip Huawei để huấn luyện mô hình mới vào quý IV năm nay hoặc quý I năm sau. Tuy nhiên, Liang không đề cập quy mô nguồn cung mà Huawei có thể cung cấp.
Huấn luyện mô hình AI đòi hỏi chip mạnh hơn so với chip dùng cho suy luận. Theo The Information, việc DeepSeek tăng sử dụng chip Huawei cho huấn luyện cho thấy hai công ty đang đẩy mạnh hợp tác để ứng phó với các biện pháp kiểm soát xuất khẩu chip từ Chính phủ Mỹ.
Liang cũng cho rằng trong vài năm tới, chip Huawei có thể đạt trình độ tương đương Nvidia. Vì vậy, theo ông, DeepSeek cần sớm thích nghi với các lựa chọn bán dẫn ngoài Nvidia.
Hiện DeepSeek đang huấn luyện một mô hình quy mô 2 nghìn tỷ tham số. Mô hình chủ lực V4 của công ty hiện có 1,4 nghìn tỷ tham số. Song song đó, DeepSeek cũng lên kế hoạch phát triển mô hình 8 nghìn tỷ tham số.