OpenAI cảnh báo các mô hình trí tuệ nhân tạo (AI) dạng open-weight với mức rào chắn an toàn thấp có thể bị tinh chỉnh và bổ sung thêm năng lực tính toán để tiến gần năng lực tấn công mạng của các mô hình frontier. Trước nguy cơ này, doanh nghiệp cần sớm chuyển sang mô hình phòng thủ dựa trên tác nhân AI.
Phát biểu tại hội thảo “AI Risk Conference Seoul 2026” do Aim Intelligence tổ chức tại Samsung Financial Campus, quận Seocho, Seoul, ngày 7/9, Wana Tun, chuyên gia về an ninh AI ứng dụng tại OpenAI, cho biết công ty không quá lo ngại việc các mô hình frontier tự mình phát động tấn công mạng. Theo ông, rủi ro lớn hơn nằm ở chỗ kẻ tấn công có thể tinh chỉnh các mô hình open-weight để gây ra thiệt hại đáng kể.
Ông cho rằng ngay cả những mô hình không thuộc nhóm frontier vẫn có thể nâng cao năng lực tấn công nếu được cung cấp đủ thời gian xử lý và lượng token. Khoảng cách về năng lực so với các mô hình frontier hiện chỉ vào khoảng 6-8 tháng.
Theo Wana Tun, các cuộc tấn công mạng sử dụng AI đang tiến hóa rất nhanh theo hướng ngày càng tự chủ hơn.
Ông cho biết vào năm 2022, AI chủ yếu được dùng như một công cụ hỗ trợ lập trình. Sau bốn năm, AI không chỉ có thể tìm lỗ hổng và viết mã khai thác mà còn đủ khả năng tự thực hiện các cuộc tấn công mạng.
Giải thích rõ hơn, ông nói AI hiện có thể thực hiện liên tiếp các bước trinh sát, quét hệ thống, tìm lỗ hổng trong phạm vi mà các thiết bị bảo mật đang kiểm soát, rồi tiếp tục chiếm quyền điều khiển mạng. Nhiều tác nhân phụ cũng có thể hoạt động song song hoặc trao đổi thông tin với nhau để duy trì cuộc tấn công trong thời gian dài.
Wana Tun mô tả tương quan giữa hệ thống bảo mật doanh nghiệp hiện nay và các cuộc tấn công dựa trên AI là một “cuộc chiến bất đối xứng”. Theo ông, khi xử lý sự cố theo thời gian thực, con người chỉ có thể xử lý một lượng thông tin hữu hạn, trong khi AI có thể duy trì hàng triệu ngữ cảnh cùng lúc. Đây cũng là lý do các cuộc tấn công dùng AI trở nên nguy hiểm hơn, khi có thể liên kết nhiều tác vụ và triển khai song song ở quy mô lớn.
Từ đó, ông nhấn mạnh hệ thống phòng thủ của doanh nghiệp cũng cần được chuyển đổi sang mô hình lấy tác nhân AI làm trung tâm.
Cụ thể, OpenAI đề xuất doanh nghiệp triển khai các tác nhân AI để giám sát thay đổi trong mạng và phân tích sự cố nhằm rút ngắn thời gian phát hiện và ứng phó. AI nên đảm nhiệm các khâu như phát hiện lỗ hổng, kiểm chứng khả năng bị khai thác và tạo bản vá, trong khi con người tập trung vào quyết định cuối cùng.
Ông cũng lưu ý rằng trong bối cảnh AI đã có thể tự tương tác với môi trường và phối hợp giữa nhiều tác nhân để hành động, doanh nghiệp cần chuẩn bị năng lực ứng phó với các mối đe dọa mạng theo hướng agentic.
Theo OpenAI, hướng đi phù hợp là tích hợp tác nhân AI vào hệ thống hiện có, thay vì thay thế hoàn toàn các giải pháp an ninh mạng truyền thống bằng AI.
Wana Tun nhấn mạnh rằng kẻ tấn công đã vận hành ở “tốc độ máy”. Vì vậy, doanh nghiệp cần nhanh chóng tự động hóa quy trình bảo mật, không chỉ dừng ở khâu phát hiện lỗ hổng mà phải mở rộng sang kiểm chứng khả năng khai thác trong thực tế và tạo bản vá.