Ảnh: Shutterstock

Axios ngày 1/9 đưa tin OpenAI sắp ra mắt mô hình mới mang tên Astra, nhưng các tính năng an ninh mạng nâng cao của hệ thống này trước mắt chỉ được mở cho một nhóm thử nghiệm chọn lọc.

Theo OpenAI, công ty sẽ giới hạn quyền truy cập đối với các khả năng an ninh mạng nhạy cảm để giảm rủi ro bị lạm dụng.

Axios cho biết Astra là mô hình đầu tiên được OpenAI tự xếp vào mức rủi ro an ninh mạng “CRITICAL”. Điều này đồng nghĩa việc triển khai an toàn một mô hình có thể tự phát hiện lỗ hổng chưa được công bố, thậm chí xây dựng phương thức khai thác, đang đặt ra thách thức mới cho công ty.

Tại một buổi briefing, Amelia Glaze, Phó chủ tịch phụ trách nghiên cứu của OpenAI, nói Astra có thể tự phát hiện những lỗi bảo mật chưa được biết đến trong các hệ thống có nhiều lớp phòng thủ, đồng thời phát triển cách khai thác ngay cả khi không có sự can thiệp của con người.

OpenAI cho biết đã bổ sung nhiều cơ chế an toàn nhằm ngăn người dùng xấu lợi dụng hệ thống, đồng thời hạn chế các hành vi ngoài kiểm soát của mô hình. Công ty hiện chưa công bố thời điểm phát hành rộng rãi.

OpenAI cũng cảnh báo các lớp bảo vệ này có thể nhận diện nhầm hoạt động bình thường là hành vi lạm dụng hoặc hành động vượt ngoài phạm vi cho phép. Trong trường hợp đó, các tác vụ hợp lệ không liên quan hoặc những quy trình agent chạy dài có thể bị trì hoãn hoặc dừng lại.

Trong quá trình thử nghiệm, Astra đã phát hiện hai lỗ hổng zero-day và xác định cách xâu chuỗi chúng để khai thác.

OpenAI cũng thừa nhận rằng trong vụ tấn công liên quan đến Hugging Face trước đó, công ty đã vô hiệu hóa một số cơ chế an toàn của sản phẩm trong khuôn khổ thử nghiệm. Theo OpenAI, nếu các cơ chế này được bật, sự cố có thể đã được ngăn chặn.

Sau sự việc đó, OpenAI cho biết đã tăng cường huấn luyện mô hình để từ chối dứt khoát hơn các yêu cầu tấn công mạng độc hại, đồng thời bổ sung thêm biện pháp chống lạm dụng và công cụ giám sát nhằm chặn các hành vi ngoài kiểm soát.

Công ty cũng thừa nhận việc siết quyền truy cập lần này có thể ảnh hưởng đến cả các hoạt động chính đáng của cơ quan và doanh nghiệp trong quá trình rà soát, khắc phục lỗ hổng. Fuad Martin, nhà nghiên cứu tại OpenAI, cho biết các khả năng này có thể giúp bên phòng thủ phát hiện và vá lỗi nhanh hơn, nhưng nếu thiếu rào chắn an toàn, chúng cũng có thể khiến bên tấn công trở nên nguy hiểm hơn. Theo ông, OpenAI đang nỗ lực để ngăn kịch bản đó xảy ra.

Từ khóa

#OpenAI #Astra #trí tuệ nhân tạo #an ninh mạng #lỗ hổng zero-day #Axios
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.