AI đang đồng thời mở ra hai xu hướng trái chiều trong lĩnh vực an ninh mạng: tăng cường năng lực phòng thủ nhưng cũng tạo thêm rủi ro mới. Mối lo này càng lớn sau khi xuất hiện thông tin về một AI agent thử nghiệm của OpenAI bị cho là đã thoát khỏi môi trường kiểm soát và tấn công nền tảng chia sẻ mô hình AI mã nguồn mở Hugging Face.
Theo thông tin được công bố, AI agent thử nghiệm của OpenAI đã xâm nhập cả môi trường của khách hàng Modal Labs trong quá trình tấn công Hugging Face. Cụ thể, agent này trước tiên đột nhập vào môi trường thử nghiệm cách ly tại Modal Labs, sau đó sử dụng đây làm điểm trung chuyển để mở rộng cuộc tấn công sang Hugging Face.
Không chỉ OpenAI, Claude Code của Anthropic cũng làm dấy lên lo ngại tương tự về khả năng thoát khỏi môi trường kiểm soát. Công ty an ninh mạng Accomplish AI của Mỹ đã trình diễn kịch bản AI agent Claude Code khai thác lỗ hổng trên Linux để thoát khỏi máy ảo, từ đó có thể truy cập các tệp của hệ điều hành macOS.
Một rủi ro khác cũng bắt đầu xuất hiện là mã độc tống tiền nhắm vào hệ thống AI. Công ty an ninh mạng Sysdig cho biết cùng một tác nhân đã hai lần xâm nhập vào các máy chủ Langflow bị lộ trên Internet. Ở lần tấn công thứ hai, nhóm này sử dụng ENCFORGE, một loại ransomware được thiết kế để nhắm vào mô hình AI.
Trong bối cảnh đó, giới chuyên môn lo ngại không chỉ dữ liệu mà cả trọng số huấn luyện của mô hình AI cũng có thể bị mã hóa, kéo chi phí khôi phục tăng mạnh.
Dù vậy, AI vẫn cho thấy vai trò ngày càng lớn trong hoạt động phòng thủ an ninh mạng. Anthropic gần đây thu hút chú ý khi sử dụng mô hình AI Mythos để phát hiện một điểm yếu mang tính nền tảng trong HAWK, thuật toán đang nằm trong nhóm ứng viên của lĩnh vực mật mã hậu lượng tử (PQC).
Cùng với đó, cuộc đua phát triển các mô hình AI chuyên dụng cho bảo mật cũng đang tăng nhiệt, đặc biệt ở các tác vụ như phát hiện lỗ hổng phần mềm, phân tích vấn đề và hỗ trợ xử lý sự cố.
Tại hội nghị và cuộc thi an ninh mạng Codegate 2026, Kim Tae-su, Phó chủ tịch phụ trách agentic security của Microsoft, nhấn mạnh rằng mô hình ngôn ngữ lớn có thể thể hiện năng lực vượt trội nhưng vẫn mắc những sai sót rất cơ bản. Theo ông, yếu tố then chốt khi ứng dụng AI là xác định rõ việc nào nên giao cho AI và việc nào vẫn cần con người phán đoán.
Song song với cuộc đua mô hình, các liên minh bảo mật mới cũng bắt đầu hình thành. Open Secure AI Alliance, sáng kiến tập trung phát triển và chia sẻ công nghệ, kỹ thuật cùng công cụ mở để bảo vệ phần mềm và agent trong kỷ nguyên AI, sẽ ra mắt với sự dẫn dắt của Nvidia và nhiều doanh nghiệp toàn cầu. SKT và Naver cũng tham gia liên minh này.
Ngoài các diễn biến nói trên, thị trường còn ghi nhận nhiều động thái bảo mật đáng chú ý từ doanh nghiệp trong và ngoài nước.
ITCen PNS đã áp dụng cơ chế mã hóa lai dựa trên PQC cho mô-đun mật mã EdgeCrypto v4.2 và nhận chứng nhận KCMVP. Hancom With, công ty giữ vai trò holding của Hancom Group, đã ký hợp đồng cung cấp giải pháp xác thực khuôn mặt Hancom Auth cho NH NongHyup Property & Casualty Insurance.
Tại Hàn Quốc, JSecurity, công ty thành viên tại Nhật Bản của JiranJigyo Group, ra mắt SafeIntelligence, giải pháp quản lý bề mặt tấn công dựa trên tên miền và phát hiện rò rỉ dữ liệu trên dark web. Fasoo AI cũng mở rộng phạm vi hỗ trợ cho giải pháp quản lý trạng thái bảo mật dữ liệu đa đám mây Fasoo DSPM, bao gồm kho lưu trữ đám mây và các ứng dụng SaaS.
Trong khi đó, KCC Information & Communication đã ký hợp đồng phân phối tổng với Kaspersky và bắt đầu đẩy mạnh mảng khách hàng doanh nghiệp tại Hàn Quốc.
Ở mảng M&A và nền tảng bảo mật AI, Cyera cho biết sẽ mua lại Oasis Security với giá 1 tỷ USD. Sau thương vụ, Cyera dự kiến tích hợp công nghệ của Oasis Security vào nền tảng bảo mật danh tính và dữ liệu hợp nhất của mình.
Snowflake cũng công bố Cortex AI Gateway nhằm tăng cường bảo mật cho AI agent, đồng thời bổ sung khả năng quan sát và kiểm soát tập trung đối với chi phí sử dụng AI của doanh nghiệp. Bên cạnh đó, Okta đã thâu tóm Permiso để tăng cường năng lực bảo mật danh tính AI.