Ảnh: Shutterstock

Việc một số mô hình AI của OpenAI thoát khỏi môi trường sandbox trong quá trình thử nghiệm và xâm nhập vào các tài khoản trên Hugging Face đang làm gia tăng lo ngại rằng các mối đe dọa an ninh mạng dựa trên AI đã trở thành hiện thực. Theo CNBC ngày 1/8, vụ việc cho thấy AI agent có thể tự tìm cách đạt mục tiêu bằng những phương thức khó lường.

OpenAI tuần trước cho biết trong quá trình kiểm thử nội bộ, một số mô hình AI khi tìm kiếm thông tin liên quan đến hành vi gian lận đã xâm nhập nền tảng mã nguồn mở Hugging Face, đồng thời xâm nhập thêm 4 tài khoản khác. Phía Hugging Face nhận định đây là trường hợp đầu tiên một cuộc tấn công được thực hiện trọn vẹn bởi hệ thống AI dạng agent.

Giới an ninh mạng trong nhiều tháng qua đã liên tục cảnh báo AI có thể làm thay đổi bức tranh đe dọa. Mối lo nằm ở chỗ những cuộc tấn công từng mất nhiều ngày, thậm chí nhiều tuần, có thể bị rút ngắn xuống chỉ còn vài phút. Sam Curry, Giám đốc An ninh Thông tin của Zscaler, nói rằng “chiếc hộp Pandora đã mở” và cho rằng doanh nghiệp cần chấp nhận AI là một thực tế sắp đến rất gần.

Sau khi mô hình Mythos của Anthropic được công bố, lo ngại cũng gia tăng rằng hacker có thể tận dụng các mô hình như vậy để khai thác lỗ hổng. Các tập đoàn công nghệ lớn đã thành lập một liên minh nhằm thử nghiệm các hệ thống AI tiên tiến để chuẩn bị ứng phó. Khi đó, Lee Klarich, lãnh đạo phụ trách sản phẩm và công nghệ tại Palo Alto Networks, cảnh báo doanh nghiệp phải tăng tốc năng lực phòng thủ trong vòng 3 đến 5 tháng.

Vụ việc lần này diễn ra ngay trước thềm hội nghị an ninh mạng thường niên Black Hat, dự kiến tổ chức tại Las Vegas vào tuần tới. Đây cũng là sự kiện quy mô lớn đầu tiên diễn ra sau khi các mô hình như Mythos được công bố rộng rãi, trong bối cảnh giới chức ngày càng quan tâm hơn tới an ninh AI.

Lo ngại của doanh nghiệp hiện không chỉ dừng ở việc ngăn chặn tin tặc, mà còn mở rộng sang rủi ro phát sinh khi triển khai AI trong nội bộ. Vài ngày sau đó, Anthropic cho biết đã xác nhận 3 trường hợp mô hình Claude truy cập trái phép vào các hệ thống vận hành thực tế của 3 tổ chức khác nhau.

Theo các chuyên gia, đây không phải lần đầu xuất hiện các vụ tấn công do AI agent thực hiện. Tuy nhiên, những trường hợp liên quan đến OpenAI, Hugging Face và Anthropic thu hút sự chú ý lớn hơn vì quy mô cũng như mức độ nổi tiếng của các bên liên quan. Chandra Gnanasambandam, lãnh đạo công nghệ của SailPoint, cho rằng những hành vi cực đoan như xóa mã là trường hợp hiếm, nhưng việc AI giành được quyền truy cập trái phép lại phổ biến hơn nhiều người nghĩ và vẫn diễn ra hằng ngày. Trong khi đó, Sanaaz Yashar, CEO của Zafran Security, nhận định rằng trong quá trình theo đuổi mục tiêu, AI có thể vô hiệu hóa hoặc tìm cách vượt qua các rào cản cản đường.

Từ khóa

#OpenAI #Hugging Face #AI agent #an ninh mạng #Anthropic #Black Hat #trí tuệ nhân tạo
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.