Ảnh: Shutterstock

Hơn 120 tổ chức, trong đó có Nvidia, Cisco và CrowdStrike, đang thúc đẩy một khuôn khổ chung nhằm báo cáo và lưu vết có hệ thống các sự cố bảo mật liên quan đến AI agent.

Động thái này diễn ra khi AI agent ngày càng có khả năng tự thực hiện tác vụ trên nhiều hệ thống và công cụ máy tính mà không cần con người can thiệp trực tiếp, làm gia tăng nhu cầu chia sẻ rủi ro và thông tin sự cố trên phạm vi toàn ngành.

Theo Axios ngày 11/8 (giờ địa phương), Open Secure AI Alliance đã xây dựng dự thảo hướng dẫn cho hệ thống báo cáo sự cố an ninh mạng liên quan đến AI agent mang tên SAFE, viết tắt của Shared AI Findings Exchange.

Dự thảo hướng tới nhiều nhóm tham gia, gồm doanh nghiệp triển khai và phát triển mô hình AI, nhà cung cấp đám mây và công cụ, các nhà nghiên cứu độc lập và đơn vị vận hành hạ tầng trọng yếu. Cơ quan nhà nước có thể tham gia với vai trò quan sát viên, nhưng không có quyền biểu quyết.

Theo dự thảo, thành viên phải báo cáo các trường hợp hệ thống AI truy cập hoặc tấn công hệ thống của bên thứ ba khi chưa được cho phép, làm lộ hoặc xâm phạm thông tin mật, hoặc tiếp tục dò quét hệ thống đang vận hành dù có dấu hiệu không được cấp quyền truy cập. Một số tình huống “suýt gây sự cố” cũng nằm trong diện phải báo cáo.

Khi sự cố xảy ra, dự thảo yêu cầu lưu giữ các dữ liệu như prompt, thông tin truy vết tác vụ của agent, nhật ký gọi công cụ, danh tính người dùng, quyền hạn và thông tin xác thực. Tổ chức bị ảnh hưởng phải được thông báo sớm nhất có thể, đồng thời SAFE phải nhận được báo cáo ban đầu dưới dạng không công khai trong vòng 4 ngày làm việc.

Trong trường hợp cần thiết, các bên sẽ công bố thông tin sơ bộ trong vòng 30 ngày và chia sẻ biện pháp khắc phục trong vòng 90 ngày.

Dự thảo cũng nêu rõ chủ đích của hệ thống AI không phải là yếu tố quyết định nghĩa vụ báo cáo. Ngay cả khi hệ thống được cho là đang hoạt động trong môi trường thử nghiệm, nghĩa vụ này vẫn áp dụng nếu đã truy cập vào hệ thống thực.

Sáng kiến được đưa ra trong bối cảnh liên tiếp xuất hiện các trường hợp AI agent vượt ra ngoài môi trường kiểm thử bảo mật có kiểm soát để truy cập hệ thống của bên thứ ba. Justin Boitano, Phó chủ tịch phụ trách mảng điện toán doanh nghiệp tại Nvidia, cho biết SAFE áp dụng khái niệm “hộp đen” trong ngành hàng không Mỹ vào điều tra sự cố AI.

Theo ông, mục tiêu là xây dựng một cơ chế ghi lại toàn bộ hành vi của AI agent như “hộp đen”, từ đó phục vụ phân tích nguyên nhân và hình thành các biện pháp kiểm soát bảo mật dùng chung cho toàn ngành.

Dù vậy, SAFE hiện vẫn chưa có cơ chế “safe harbor” chính thức, tức cơ chế miễn trừ trách nhiệm pháp lý cho doanh nghiệp khi tự nguyện công bố thông tin sự cố nhạy cảm. Tuy nhiên, các bên tham gia cho rằng mô hình này vẫn có thể thu hút sự tham gia tự nguyện nhờ văn hóa chia sẻ thông tin về mối đe dọa vốn đã phổ biến trong lĩnh vực an ninh mạng.

Open Secure AI Alliance dự kiến sẽ tiếp nhận ý kiến từ doanh nghiệp và giới nghiên cứu về dự thảo SAFE thông qua quy trình lấy ý kiến do Linux Foundation vận hành, trước khi hoàn thiện bản cuối cùng.

Từ khóa

#Nvidia #Cisco #CrowdStrike #Open Secure AI Alliance #AI agent #SAFE #Shared AI Findings Exchange #an ninh mạng #báo cáo sự cố
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.