Ảnh: Shutterstock

Z.ai, startup AI của Trung Quốc, ngày 15/8 công bố GLM-5.3, mô hình chuyên cho an ninh mạng, trong bối cảnh các công ty AI Trung Quốc tăng tốc mở rộng ảnh hưởng sang lĩnh vực này nhờ lợi thế từ các mô hình open-weight.

Theo Z.ai, GLM-5.3 cải thiện đáng kể hiệu năng so với phiên bản tiền nhiệm ở các tác vụ phát hiện lỗ hổng, phân tích khai thác và xử lý quy trình bảo mật nhiều bước. Công ty cũng cho biết sẽ công bố trọng số mô hình trong vòng hai tuần tới.

Z.ai cho biết việc ra mắt GLM-5.3 diễn ra sau khi Hugging Face gần đây điều tra sự cố liên quan đến GLM-5.2, khi mô hình này tự vượt qua cơ chế an toàn. Từ đó, công ty nhấn mạnh kỷ nguyên AI tham gia đồng thời vào cả tấn công lẫn phòng thủ mạng đã bắt đầu; trong bối cảnh các kỹ thuật tấn công ngày càng phổ biến, năng lực phòng thủ không nên chỉ tập trung ở một số ít tổ chức lớn.

GLM-5.3 thu hút chú ý khi được Z.ai giới thiệu là có năng lực tiệm cận Claude Mythos 5, mô hình an ninh mạng của Anthropic hiện được cung cấp với phạm vi truy cập hạn chế.

Trên CyberGym, bộ benchmark đánh giá khả năng phát hiện lỗ hổng trong mã nguồn, GLM-5.3 vượt Claude Mythos 5. Tuy nhiên, ở hai benchmark an ninh mạng khác, mô hình này vẫn xếp sau Claude Mythos 5.

Cụ thể, trên CyberGym, GLM-5.3 đạt 84,5%, tăng từ 77,2% của GLM-5.2. Ở ExploitBench, thước đo khả năng chuyển từ phát hiện lỗ hổng sang khai thác thực tế, mô hình đạt 54,4%, cao hơn hai lần so với mức 24,4% của phiên bản trước. Với ExploitGym, bài kiểm tra năng lực hoàn thành tác vụ khai thác trong thời gian giới hạn, GLM-5.3 hoàn tất 105 bài trong 2 giờ và 130 bài trong 6 giờ, trong khi GLM-5.2 chỉ đạt lần lượt 29 và 39 bài.

Theo Z.ai, trong quá trình kiểm chứng trên các codebase thực tế cùng các trường đại học và đội ngũ an ninh mạng chuyên nghiệp, GLM-5.3 đã phát hiện 2.436 lỗ hổng trên 269 dự án. Trong số này, 1.097 lỗ hổng được xếp ở mức nghiêm trọng từ trung bình trở lên.

Các kết quả nói trên trải rộng ở nhiều lĩnh vực, bao gồm hệ điều hành, trình duyệt, website, thiết bị mạng và thiết bị thông minh.

Z.ai cho biết công ty đang vận hành quy trình công bố lỗ hổng riêng. Các lỗ hổng được phát hiện sẽ được xác minh và tái hiện trước khi gửi tới nhóm duy trì dự án liên quan; những vấn đề chưa hoàn tất điều phối sẽ không được công bố chi tiết. Để bảo đảm tính minh bạch, công ty cũng vận hành sổ cái công bố bảo mật nội bộ mang tên Z.ai Security Disclosure Ledger.

Theo lộ trình được công bố, Z.ai trước tiên sẽ để một số đối tác an ninh được lựa chọn đánh giá GLM-5.3 trong môi trường kiểm soát, sau đó mở rộng quyền truy cập API. Khi hoàn tất quá trình kiểm chứng an toàn và sẵn sàng phát hành, công ty sẽ công bố toàn bộ trọng số mô hình.

Về an toàn, Z.ai cho biết GLM-5.3 được triển khai cơ chế bảo vệ ba lớp. Hệ thống này gồm bộ phân loại bên ngoài để lọc các yêu cầu nguy hiểm, bộ giám sát suy luận nhằm phát hiện tín hiệu rủi ro trong quá trình thực thi tác vụ, và cơ chế căn chỉnh an toàn chuyên sâu để giúp mô hình tự phân biệt giữa công việc bảo mật hợp pháp và hành vi độc hại.

Công ty nhấn mạnh cơ chế căn chỉnh an toàn đặc biệt quan trọng đối với các mô hình open-weight. Theo Z.ai, các lớp như bộ phân loại bên ngoài hay công cụ giám sát chỉ hoạt động trong dịch vụ do công ty cung cấp; nếu người dùng triển khai mô hình cục bộ, các lớp bảo vệ này sẽ không còn hiệu lực.

Bên cạnh đó, Z.ai cũng khởi động sáng kiến OpenVuln nhằm hỗ trợ bảo mật cho phần mềm mã nguồn mở. OpenVuln tập trung kiểm toán bảo mật cho các dự án thiếu nguồn lực, đồng thời hỗ trợ công bố và khắc phục lỗ hổng.

Z.ai cho rằng phần lớn hạ tầng số toàn cầu hiện phụ thuộc vào phần mềm mã nguồn mở do các nhóm nhỏ vận hành. Nếu năng lực phòng thủ chỉ tập trung ở một số tổ chức, những dự án thiếu nguồn lực nhất sẽ buộc phải tự bảo vệ các thành phần quan trọng nhất của hạ tầng số. Vì vậy, theo công ty, lĩnh vực an ninh mạng cũng cần những mô hình mở như GLM-5.3.

Từ khóa

#Z.ai #GLM-5.3 #an ninh mạng #mô hình open-weight #Hugging Face #CyberGym #ExploitBench #ExploitGym #Anthropic #Claude Mythos 5
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.