OpenAI giới thiệu Private Safety Processing, cơ chế phát hiện lạm dụng AI qua nhiều phiên mà không lưu dữ liệu hội thoại. Ảnh: Shutterstock

OpenAI đang thử nghiệm một cơ chế an toàn mới cho khách hàng doanh nghiệp, cho phép phát hiện hành vi lạm dụng AI qua nhiều phiên làm việc mà không lưu dữ liệu hội thoại của người dùng.

Ngày 19/8 (giờ địa phương), TechCrunch cho biết OpenAI đã mở thử nghiệm sớm tính năng “Private Safety Processing” cho một số khách hàng. Mục tiêu là tăng khả năng phát hiện rủi ro lạm dụng mà vẫn giữ nguyên nguyên tắc không lưu dữ liệu khách hàng.

Điểm mới của công nghệ này là khả năng phân tích tín hiệu rủi ro trên nhiều phiên tương tác thay vì chỉ trong một phiên riêng lẻ. Trước đây, với chính sách “Zero Data Retention” (ZDR), OpenAI vẫn không lưu dữ liệu khách hàng nhưng phạm vi giám sát chủ yếu chỉ giới hạn trong từng phiên.

Theo OpenAI, Private Safety Processing giúp mở rộng cơ chế bảo vệ của ZDR bằng cách đối chiếu đồng thời đầu vào và đầu ra từ nhiều phiên để nhận diện dấu hiệu lạm dụng. Khi hệ thống phát hiện một mẫu hành vi nhất định, nó sẽ tiếp tục phân tích tương tác liên phiên. Công ty nhấn mạnh không có chuyện con người trực tiếp xem nội dung hội thoại của người dùng trong quá trình này.

OpenAI cho rằng cách tiếp cận trên đặc biệt hữu ích với các hành vi xấu được chia nhỏ qua nhiều phiên để tránh bị phát hiện. Chẳng hạn, một đối tượng muốn phát triển mã độc phục vụ tấn công mạng có thể tách yêu cầu thành nhiều cuộc trao đổi khác nhau; Private Safety Processing được thiết kế để nhận diện kiểu mẫu này.

Khi cơ chế được kích hoạt, OpenAI cho biết hãng chỉ tiếp nhận những tín hiệu đã được giới hạn chặt chẽ, nhằm cảnh báo cho một loại hành vi cụ thể. Từ đó, công ty sẽ đánh giá có cần áp dụng biện pháp xử lý hay không. Trong trường hợp cần thiết, OpenAI có thể đề nghị khách hàng cung cấp thêm ngữ cảnh hoặc phối hợp giải quyết, còn việc chia sẻ dữ liệu vẫn do khách hàng quyết định.

Động thái của OpenAI diễn ra trong bối cảnh chính sách lưu dữ liệu mới của Anthropic thu hút nhiều chú ý. Theo chính sách công bố hồi tháng 7, Anthropic có thể lưu phiên làm việc và nội dung hội thoại của người dùng trong 30 ngày đối với một số mô hình thuộc diện áp dụng. Nhóm này bao gồm toàn bộ các mô hình cấp Mythos và những mô hình tương lai có năng lực tương đương. Công ty cho biết mục đích là phục vụ công tác an toàn và theo dõi hành vi có thể không phù hợp, song chính sách này đã làm dấy lên lo ngại trong nhóm doanh nghiệp xử lý lượng lớn dữ liệu nhạy cảm.

Anthropic nhìn chung vẫn theo đuổi nguyên tắc Zero Data Retention, nhưng một số mô hình nằm trong diện áp dụng, như Fable, là ngoại lệ. Công ty cũng thừa nhận có thể phát sinh việc con người xem xét dữ liệu khách hàng, song nhấn mạnh chỉ một số ít nhân sự được phê duyệt mới có quyền truy cập thông qua các kênh kiểm soát. Theo Anthropic, mỗi lần xem xét đều được ghi lại trong nhật ký chống can thiệp và không thể bị người kiểm tra tự ý chặn hoặc chỉnh sửa.

Với OpenAI, đây được xem là nỗ lực tìm điểm cân bằng giữa an toàn hệ thống và quyền riêng tư dữ liệu của khách hàng doanh nghiệp. Khi năng lực mô hình AI ngày càng tăng, rủi ro bị lạm dụng cũng lớn hơn, trong khi doanh nghiệp vừa muốn tăng lớp bảo vệ vừa muốn giữ quyền kiểm soát dữ liệu.

Cuộc cạnh tranh giữa OpenAI và Anthropic cũng là một phần bối cảnh của lần công bố này. Một báo cáo gần đây cho biết đà tăng trưởng trong quý II của OpenAI chậm hơn Anthropic. Doanh thu thường niên hóa của Anthropic được cho là đã đạt 65 tỷ USD, tương đương khoảng 90.350 tỷ won. Trên thị trường đầu tư, cũng xuất hiện đồn đoán rằng công ty có thể IPO với mức định giá 2.000 tỷ USD, tương đương khoảng 2.800 nghìn tỷ won. OpenAI cũng đang chuẩn bị IPO, vì vậy cuộc đua về chính sách bảo mật và quyền riêng tư dành cho khách hàng doanh nghiệp nhiều khả năng sẽ tiếp tục nóng lên.

Từ khóa

#OpenAI #Anthropic #Private Safety Processing #Zero Data Retention #ZDR #AI #quyền riêng tư dữ liệu #an toàn AI #API
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.