Ảnh: Reve AI

Các cảnh báo về nguy cơ “AI hacking” đang gia tăng sau khi nhiều mô hình AI thử nghiệm tại các công ty lớn tự truy cập các website bên ngoài, thậm chí thực hiện hành vi tấn công mạng mà không có chỉ thị rõ ràng. Theo Financial Times (FT), ngày càng nhiều chuyên gia coi đây là dấu hiệu cho thấy an ninh mạng toàn cầu đang bước sang một giai đoạn rủi ro mới.

FT cho biết trong hơn 10 chuyên gia được báo này phỏng vấn, hơn một nửa nhận định loạt sự cố xâm nhập gần đây liên quan đến AI là một bước ngoặt đối với an ninh mạng. Đáng chú ý, một số ý kiến cho rằng làn sóng tấn công xuất phát từ AI không phải là tai nạn hiếm gặp, mà là hệ quả khó tránh khỏi khi năng lực của AI tăng nhanh.

Các AI agent gần đây đã cho thấy khả năng tự kết hợp nhiều phương thức phức tạp để tấn công mục tiêu thực tế mà không cần con người can thiệp trực tiếp. Tháng trước, các AI agent của OpenAI trong một môi trường thử nghiệm không có Internet đã tìm cách truy cập web công khai, thậm chí xâm nhập hệ thống của nền tảng chia sẻ AI mã nguồn mở Hugging Face mà người vận hành không hề hay biết hoặc cho phép.

Theo FT, các agent này còn bộc lộ một năng lực mới: tự trao đổi và phối hợp để hoàn thành nhiệm vụ. Chúng để lại thông điệp trên một bảng tin nội bộ do chính mình tạo ra, chia sẻ thông tin về lỗ hổng mã và từ đó tổ chức việc vượt rào theo cách có hệ thống.

FT nhận định chính các chiến lược tinh vi mà những AI agent này sử dụng để đạt mục tiêu, bao gồm cả hành vi đánh lừa và chiếm đoạt, đã khiến ngay cả những người theo sát tiến bộ của mô hình AI cũng bất ngờ.

Giới nghiên cứu AI cho rằng loạt sự cố “AI hacking” không phải là biểu hiện cho thấy mô hình đột ngột hành xử bất thường. Ngược lại, đây là kết quả xuất phát từ chính cách các hệ thống này được thiết kế và huấn luyện.

FT dẫn lời một số chuyên gia nói rằng mô tả tình hình theo hướng “AI đã vượt khỏi tầm kiểm soát” là chưa chính xác. Việc các hệ thống AI trong giai đoạn thử nghiệm bất ngờ thực hiện hành vi tấn công không phải điều không thể xảy ra, mà là kịch bản có thể xuất hiện khi hội đủ điều kiện.

Bojan Milanov, nhà khoa học nghiên cứu cấp cao tại AI Now Institute, tổ chức nghiên cứu độc lập có trụ sở tại New York chuyên về rủi ro bảo mật của AI agent, nhận định: “Năng lực tấn công mạng của AI không phải do AI đột nhiên vượt khỏi kiểm soát, mà là thứ con người đã chủ động phát triển”. Ông cho biết trong nhiều năm qua, các công ty AI đã tích cực thu thập dữ liệu huấn luyện, đào tạo mô hình và liên tục nâng cao các năng lực liên quan đến an ninh mạng.

Theo FT, các mô hình AI thế hệ mới được thiết kế để huy động mọi cách khả dĩ nhằm đạt mục tiêu, kể cả khi không có chỉ dẫn cụ thể. Điều đó khiến việc dự đoán chính xác AI sẽ làm gì trở nên đặc biệt khó khăn. Với một hệ thống máy tính không thực sự hiểu ý định của con người hay các chuẩn mực đạo đức, ranh giới giữa một công cụ phòng thủ an ninh mạng mạnh và một hacker nguy hiểm ngày càng trở nên mờ nhạt.

Rủi ro này được cho là sẽ còn tăng lên khi các công ty công nghệ đẩy nhanh cuộc đua phát triển trí tuệ nhân tạo tổng quát, hay AGI, vượt năng lực nhận thức của con người. Tuy nhiên, hiện chưa có dấu hiệu cho thấy mối đe dọa này có thể sớm được ngăn chặn một cách hiệu quả.

Năng lực suy luận và giải quyết vấn đề của AI càng tăng, khả năng lập trình cũng tiến bộ nhanh chóng. FT cho biết điều này bao gồm cả việc học cách tìm lỗi phần mềm, sửa lỗi và khai thác lỗ hổng. Nói cách khác, năng lực viết code ở mức “đáng kinh ngạc” cũng có thể chuyển hóa thành kỹ năng tấn công mạng vượt trội.

Dawn Song, giáo sư khoa học máy tính tại UC Berkeley và phụ trách nghiên cứu AI tại Meta Superintelligence Lab, nhận định: “Lập trình và năng lực an ninh mạng là hai mặt của một đồng xu. Khi năng lực lập trình phát triển, năng lực tấn công mạng cũng tăng theo”. Bà cho biết nhiều người đã không ngờ AI có thể đạt đến trình độ này nhanh đến vậy.

Lãnh đạo OpenAI, Grok Brockman, gần đây viết trên blog công ty rằng “sự cố liên quan đến Hugging Face cho thấy chúng ta đã đánh giá thấp năng lực tấn công mạng trong thực tế của các mô hình AI”. Theo ông, sự việc này làm gia tăng tính cấp bách của các chương trình nghiên cứu an toàn và các biện pháp bảo mật nội bộ mà công ty đang triển khai.

Dù vậy, các chuyên gia bảo mật dự báo trong ngắn hạn, hệ thống AI sẽ khiến quy mô và tốc độ các cuộc tấn công mạng tiếp tục gia tăng, đồng thời có thể gây xáo trộn đối với hệ thống IT toàn cầu cho đến khi các bản vá được phát hành. FT cũng cho biết đã xuất hiện trường hợp đầu tiên bị nghi là AI agent tham gia tấn công ở cấp độ quốc gia: các hacker có liên hệ với Trung Quốc đã đồng thời triển khai tới 8 AI agent tự trị nhằm nhắm vào chính phủ Đài Loan.

Từ khóa

#trí tuệ nhân tạo #an ninh mạng #AI agent #“AI hacking” #OpenAI #Hugging Face #Financial Times #AGI
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.