Meta Llama. Ảnh: Shutterstock

Meta thừa nhận một mô hình trí tuệ nhân tạo của hãng đã tự truy cập Internet và tấn công một dịch vụ bên ngoài trong quá trình kiểm thử an ninh mạng. Thông tin được The Wall Street Journal (WSJ) đăng tải ngày 6/8 theo giờ địa phương.

Theo WSJ, sự cố xảy ra trong một bài kiểm thử do đơn vị đánh giá AI độc lập Irregular thực hiện. Meta cho biết do lỗi cấu hình, mô hình này đã có thể truy cập Internet trong lúc thử nghiệm.

Một nguồn tin am hiểu vụ việc cho biết đây là cùng loại bài kiểm thử năng lực an ninh mạng từng liên quan đến các sự cố trước đó của hệ thống AI thuộc Anthropic và OpenAI.

Meta cho biết hãng chỉ biết sự việc sau khi được Irregular thông báo. Công ty hiện chưa công bố mô hình liên quan, thời điểm xảy ra sự cố, doanh nghiệp bị tấn công hay thời gian mô hình duy trì kết nối với Internet. Meta nói đang điều tra và dự kiến sẽ công bố báo cáo về vụ việc.

Về phía Irregular, đơn vị này cho biết sự cố mới nhất không phải là một cuộc tấn công mạng tinh vi. Irregular cũng khẳng định môi trường thử nghiệm hiện không còn phát sinh vấn đề. Công ty đang chuẩn bị công bố một tài liệu trắng về các thông lệ kiểm soát tốt nhất khi đánh giá năng lực an ninh mạng của mô hình AI.

Chuỗi sự cố bắt đầu được hé lộ từ cuối tháng 7, khi OpenAI cho biết một số mô hình của hãng đã thoát khỏi sandbox vốn được dùng để chặn truy cập Internet và tấn công công ty AI Hugging Face. Sau đó, Anthropic và một số bên khác cho biết trong quá trình rà soát log đã phát hiện các vụ thoát khỏi sandbox và tấn công từng xảy ra từ vài tháng trước.

Irregular được xem là bên tham gia trung tâm trong ba vụ việc này. Tuy nhiên, công ty không liên quan đến vụ tấn công Hugging Face với mức độ tinh vi cao hơn, cũng như các trường hợp nhiều mô hình cùng thoát khỏi môi trường kiểm thử trong chương trình đánh giá an toàn AI của chính phủ Anh.

Trong tuần này, chính quyền Trump cũng công bố hướng dẫn kêu gọi các mô hình AI tiên tiến mới tại Mỹ được tự nguyện gửi tới chính phủ để phục vụ kiểm thử.

Từ khóa

#Meta #AI #kiểm thử an ninh mạng #Irregular #OpenAI #Anthropic #Internet #sandbox
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.