Mô hình Kimi K3 do Moonshot AI phát triển. Ảnh: Kimi

OpenAI cho biết đã phát hiện và ngăn chặn một chiến dịch có tổ chức nhằm trích xuất quy mô lớn dữ liệu suy luận không công khai từ các mô hình AI của hãng. Theo công ty, nhóm nòng cốt đứng sau hoạt động này bị nghi có liên hệ với những cá nhân liên quan đến startup AI Trung Quốc Moonshot AI.

Theo CNBC ngày 1/10 (giờ địa phương), OpenAI cho biết hoạt động này bắt đầu ở quy mô nhỏ từ ngày 1/7. Đến ngày 24 và 25/7, hệ thống của hãng ghi nhận 16.000 yêu cầu có cùng dấu hiệu trích xuất, đến từ hơn 4.000 tài khoản người dùng.

Sau quá trình điều tra bổ sung, OpenAI xác định các hoạt động liên quan trải rộng trong một nhóm hơn 15.000 người dùng và đã tiến hành chặn vào ngày 28/7. Công ty nhấn mạnh con số 16.000 là số lần thử, không phải số lần trích xuất thành công.

OpenAI gọi hình thức này là “adversarial distillation”. Thuật ngữ này chỉ việc thu thập hàng loạt đầu ra hoặc quy trình suy luận của một hệ thống AI khác mà không được phép, nhằm phục vụ huấn luyện hoặc cải thiện hiệu năng cho mô hình riêng.

Theo OpenAI, distillation mô hình vốn là kỹ thuật phổ biến trong ngành. Tuy nhiên, vấn đề phát sinh khi kỹ thuật này bị sử dụng để sao chép trái phép các năng lực được bảo vệ của đối thủ.

Công ty cho biết vụ việc không phải một cuộc tấn công mạng theo kiểu truyền thống nhằm vào máy chủ hay cơ sở dữ liệu. Nhóm thực hiện không giải mã được cơ chế mã hóa của OpenAI và cũng không thể truy cập trực tiếp vào các cuộc hội thoại đã lưu của người dùng.

Thay vào đó, họ tìm cách khai thác quá trình tương tác với mô hình để tái tạo phần suy luận không được công khai dưới dạng đầu ra mà người dùng có thể nhìn thấy. OpenAI cho biết đã chặn các phương thức khai thác liên quan, hạn chế các tài khoản đáng ngờ và siết chặt quy trình đăng ký cũng như giám sát.

Dù vậy, việc xác định đầy đủ chủ thể đứng sau vẫn còn bỏ ngỏ. OpenAI cho biết chưa thể khẳng định toàn bộ những người tham gia đều thuộc cùng một tổ chức, nhưng nhóm hoạt động chính được cho là có liên hệ với các cá nhân liên quan đến Moonshot AI, đơn vị phát triển dịch vụ AI Kimi.

OpenAI cũng cho biết đã chia sẻ kết quả điều tra với các công ty AI khác thông qua Frontier Model Forum và các kênh chia sẻ thông tin của chính phủ.

Trước đó, Anthropic cũng từng cáo buộc các công ty AI Trung Quốc, trong đó có Moonshot AI, tìm cách tận dụng năng lực suy luận của Claude để cải thiện mô hình của họ. Anthropic cho biết đã ghi nhận hơn 23 triệu lượt tương tác liên quan đến Moonshot AI trong giai đoạn từ tháng 5 đến tháng 7 năm nay.

Moonshot AI hiện chưa phản hồi các câu hỏi liên quan đến thông báo của OpenAI.

Trong bối cảnh năng lực suy luận ngày càng trở thành tài sản cạnh tranh cốt lõi của các mô hình AI, những nỗ lực sao chép cùng các biện pháp phòng vệ được dự báo sẽ khiến cuộc đua an ninh giữa các công ty AI thêm quyết liệt.

Từ khóa

#OpenAI #Moonshot AI #Kimi #trí tuệ nhân tạo #an ninh AI #adversarial distillation
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.