Naver ngày 16/9 cho biết đã lần đầu công bố “Báo cáo tiến độ an toàn AI”, trong đó hệ thống hóa 110 nhóm rủi ro có thể phát sinh trong dịch vụ AI và giới thiệu cách doanh nghiệp áp dụng các biện pháp kiểm soát an toàn xuyên suốt từ khâu thiết kế đến vận hành.
Theo Naver, báo cáo tổng hợp quy trình đưa khung an toàn AI nội bộ ASF 2.0 vào dịch vụ thực tế, đồng thời nêu các trường hợp triển khai cụ thể.
ASF 2.0 là hệ thống quản trị an toàn AI của Naver, bao quát hiệu năng mô hình, mức độ rủi ro, bảo vệ người dùng và an toàn dịch vụ. Khung này được thiết kế để quản trị rủi ro trong toàn bộ vòng đời sản phẩm, từ thiết kế, phát triển đến triển khai và vận hành.
Báo cáo cũng trình bày cách ASF 2.0 cùng CHEC 2.0 - hệ thống triển khai dựa trên khung này - được áp dụng vào các dịch vụ thực tế.
Naver cho biết đã xây dựng N-ARTI dựa trên các tình huống pháp lý, xã hội và đặc thù từng ngành để phân loại 110 nhóm rủi ro có thể phát sinh trong dịch vụ AI. Hệ thống này giúp nhận diện và phân loại rủi ro theo đặc điểm của từng dịch vụ, đồng thời duy trì một chuẩn đánh giá thống nhất trên toàn công ty.
Trên cơ sở đó, công ty thiết lập các guardrail nhằm ngăn AI tạo sinh đưa ra phản hồi vượt ngưỡng an toàn đã được đặt trước.
Ngoài ra, Naver cũng phát triển N-ASET để đánh giá mức độ an toàn của phản hồi AI. Công cụ này chấm điểm theo hai tiêu chí là “mức độ gây hại” và “tính hữu dụng”, không chỉ kiểm tra nội dung độc hại mà còn đánh giá liệu phản hồi có phù hợp với câu hỏi hay không, cũng như có kèm các yếu tố an toàn cần thiết như tuyên bố miễn trừ trách nhiệm hoặc khuyến nghị tìm đến chuyên gia hay không.
Naver cũng công bố một số trường hợp triển khai vào dịch vụ. Theo đó, ở dịch vụ hỗ trợ mua sắm bằng AI và dịch vụ thời tiết, công ty thông báo rõ cho người dùng khi AI được sử dụng. Với “AI tab” ra mắt vào tháng 6, Naver đã áp dụng CHEC 2.0 để kiểm tra an toàn từ giai đoạn thiết kế đến trước khi phát hành.
Trong thời gian tới, công ty dự kiến mở rộng hợp tác với các trường đại học và tổ chức chuyên môn như Viện Khoa học và Công nghệ Tiên tiến Hàn Quốc (KAIST), Sáng kiến Chính sách AI của Đại học Quốc gia Seoul (SAPI), Trung tâm Nghiên cứu An toàn AI của Đại học Korea và Viện Nghiên cứu An toàn AI (AISI). Mục tiêu là tiếp tục nghiên cứu các biện pháp nhận diện, phòng ngừa và giảm thiểu rủi ro trong dịch vụ AI.
Ông Won Seong-jae, Giám đốc Trung tâm An toàn AI của Naver, cho rằng khi AI ngày càng thâm nhập sâu vào đời sống hằng ngày, vấn đề an toàn AI cũng đã bước sang giai đoạn phải được xử lý cụ thể trong môi trường dịch vụ thực tế, thay vì chỉ dừng ở thảo luận lý thuyết. Ông nhấn mạnh Naver sẽ tiếp tục nâng cấp và triển khai ASF 2.0, đặt giá trị lấy con người làm trung tâm lên hàng đầu trong toàn bộ quá trình phát triển và sử dụng AI nhằm phòng ngừa, giảm thiểu các rủi ro có thể phát sinh.