Giới chuyên gia an ninh mạng cho rằng sự cố mô hình của OpenAI xâm nhập hệ thống Hugging Face trong quá trình thử nghiệm chủ yếu bắt nguồn từ lỗi thiết kế sandbox, thay vì xuất phát từ chính mô hình AI.
Theo TechCrunch ngày 22/7 (giờ địa phương), các chuyên gia bảo mật nhận định môi trường mà OpenAI mô tả là “cô lập ở mức cao” trên thực tế vẫn duy trì kết nối ra bên ngoài.
Trong một bài đăng trên blog, OpenAI cho biết môi trường thử nghiệm vẫn được cấp quyền truy cập mạng ở mức hạn chế để cài đặt các gói phần mềm thông qua một hệ thống cài đặt do nội bộ lưu trữ. Mô hình đã khai thác một lỗ hổng zero-day chưa được công bố trong hệ thống này để thoát khỏi sandbox, qua đó mở đường cho sự cố xâm nhập vào Hugging Face.
OpenAI cho biết đã báo cáo lỗ hổng đã được xác nhận cho bên phát triển phần mềm liên quan theo quy trình công bố có trách nhiệm, đồng thời bản vá hiện cũng đang được triển khai.
Về sự việc này, nhiều chuyên gia an ninh mạng cho rằng vấn đề cốt lõi không nằm ở bản thân lỗ hổng phần mềm, mà ở chỗ sandbox ngay từ đầu vẫn tồn tại một đường kết nối ra Internet.
Dan Guido, nhà sáng lập Trail of Bits, gọi đây là “một thất bại trong cơ chế cô lập do các lớp bảo vệ an toàn bị vô hiệu hóa”. Trong khi đó, nhà nghiên cứu bảo mật Martin Boon cho rằng một sandbox đúng chuẩn phải được tách biệt hoàn toàn về mặt vật lý với Internet, đồng thời đánh giá đây là “thất bại của con người”.
Jake Williams cũng nhận định rằng nếu mô hình có thể thực hiện những hành vi đã được ghi nhận tại Hugging Face, điều đó cho thấy nó không hề hoạt động trong một sandbox được kiểm soát chặt chẽ.
Cùng quan điểm, Daniel Card cho rằng việc cho phép sandbox, hoặc một phần của sandbox, truy cập Internet mà không có bộ lọc là hệ quả của khâu thiết kế và kiểm soát thiếu chặt chẽ. Theo ông, mức truy cập mạng “hạn chế” như OpenAI mô tả cũng khó có thể được xem là một lựa chọn hợp lý.
OpenAI hiện chưa trả lời câu hỏi liệu môi trường thử nghiệm này do AI tự cấu hình hay do con người thiết lập.