Nhà sáng lập ByteDance Zhang Yi-ming cho biết công ty sẽ không sử dụng phương pháp chưng cất mô hình trong quá trình huấn luyện AI, trong bối cảnh Mỹ tăng cường giám sát cách các doanh nghiệp AI Trung Quốc phát triển mô hình.
Theo Cryptopolitan ngày 5/8 (giờ địa phương), Zhang Yi-ming gần đây đã trực tiếp tham gia vào chiến lược AI của ByteDance. Ông được cho là đã gặp nhóm nghiên cứu cấp cao để rà soát tiến độ phát triển mô hình và kiểm tra tình hình tuyển dụng nhân sự.
Diễn biến này xuất hiện đúng lúc Washington ngày càng chú ý đến việc một số viện nghiên cứu AI tại Trung Quốc tận dụng chưng cất mô hình để rút ngắn thời gian phát triển và giảm chi phí. Đây là phương pháp dùng đầu ra hoặc phản hồi từ mô hình lớn, có hiệu năng cao hơn, để huấn luyện mô hình nhỏ hơn.
Trong ngành AI, chưng cất mô hình là kỹ thuật được sử dụng khá phổ biến và trong nhiều trường hợp không bị xem là bất hợp pháp. Tuy nhiên, việc áp dụng ở quy mô lớn vẫn là vấn đề gây tranh cãi.
Theo Cryptopolitan, Zhang Yi-ming phản đối rõ ràng việc ByteDance dùng phương pháp này trong huấn luyện mô hình AI. Điều đó cho thấy công ty đang chọn hướng đi khác với một bộ phận doanh nghiệp AI Trung Quốc bị nghi tìm cách tối ưu chi phí bằng chưng cất mô hình.
Lựa chọn này cũng gắn với tham vọng phát triển Seedance, mô hình tạo video của ByteDance. Công ty quảng bá Seedance là một trong số ít sản phẩm AI của Trung Quốc vừa có khả năng thương mại hóa, vừa duy trì hiệu năng cao.
Với Seedance 2.0, nội bộ ByteDance từng xuất hiện tranh cãi về gánh nặng chi phí và mức độ mở rộng mô hình quá nhanh. Dù vậy, dự án vẫn được đẩy tiếp với mục tiêu vượt mốc 200 tỷ tham số. Khi đó, một số nhân sự trong công ty cho rằng quy mô này là quá tham vọng.
Bất chấp lo ngại về chi phí, ByteDance vẫn dồn nguồn lực vào đầu tư GPU quy mô lớn, mở rộng nguồn dữ liệu và tuyển dụng nhân tài cấp cao. Theo thông tin được đề cập, biên lợi nhuận gộp của mô hình này ở mức 70-90%. Đây cũng được xem là cơ sở để Zhang Yi-ming theo đuổi con đường tự phát triển tốn kém thay vì chọn lối đi ngắn hơn.
Mỹ gần đây cũng phản ứng mạnh hơn với việc doanh nghiệp AI Trung Quốc sử dụng chưng cất mô hình. Michael Kratsios, người đứng đầu Văn phòng Chính sách Khoa học và Công nghệ Nhà Trắng, cho rằng Moonshot AI có thể đã chưng cất mô hình Fable của Anthropic trong quá trình phát triển hệ thống AI Kimi K3.
Ông cho biết Moonshot AI đã vận hành một nền tảng nội bộ có thay đổi đường dẫn truy cập nhằm tránh bị phát hiện, đồng thời sử dụng máy chủ Nvidia GB300 tại Thái Lan. Theo các quy định kiểm soát xuất khẩu của Mỹ, dòng sản phẩm này bị cấm xuất sang Trung Quốc.
Anthropic cũng được cho là đã phát hiện khoảng 3,4 triệu cuộc hội thoại Claude được kết nối với Moonshot AI thông qua các tài khoản giả. Tuy nhiên, đến nay Moonshot AI chưa đưa ra phản hồi về cáo buộc này.
Phản ứng của chính phủ Mỹ hiện không dừng ở mức cảnh báo mà đang dần chuyển thành thảo luận chính sách. Bộ trưởng Tài chính Scott Bessent cho biết Washington có thể xem xét áp đặt trừng phạt nếu doanh nghiệp Trung Quốc triển khai chưng cất mô hình ở quy mô công nghiệp.
Tại Hạ viện Mỹ, một dự luật lưỡng đảng cũng đang được thúc đẩy nhằm giúp nhận diện dễ hơn các hoạt động chưng cất mô hình và tạo cơ sở cho các biện pháp chế tài.
Trong bối cảnh đó, giới chức và giới nghiên cứu Mỹ ngày càng lo ngại khoảng cách AI với Trung Quốc đang thu hẹp nhanh. Theo dữ liệu từ Viện Nghiên cứu AI lấy con người làm trung tâm thuộc Đại học Stanford, các mô hình hàng đầu của hai nước hiện được đánh giá là có hiệu năng gần tương đương.
Điều này củng cố nhận định rằng dù Mỹ chi cho đầu tư AI nhiều hơn Trung Quốc với tỷ lệ 23:1, lợi thế công nghệ của nước này vẫn đang bị thu hẹp.
Vì vậy, quyết định của ByteDance không chỉ là lựa chọn về phương pháp phát triển mô hình, mà còn phản ánh cục diện cạnh tranh AI giữa Mỹ và Trung Quốc. Việc các doanh nghiệp Trung Quốc sẽ chọn chiến lược huấn luyện và hạ tầng nào dưới sức ép từ các quy định của Mỹ, cùng với việc ByteDance có tiếp tục theo đuổi định hướng tự phát triển với Seedance hay không, sẽ là những điểm đáng chú ý tiếp theo.