OpenAI đang đối mặt với tranh cãi sau khi bị cho là triển khai một dự án nội bộ, trong đó lao động hợp đồng đọc và chấm điểm các cuộc trò chuyện thực tế của người dùng nhằm cải thiện chất lượng phản hồi của ChatGPT. Dù công ty áp dụng bộ lọc tự động để che thông tin cá nhân, một số dữ liệu nhạy cảm được cho là vẫn có thể lọt qua.
Theo 404 Media ngày 15/9/2026 (giờ địa phương), OpenAI đang vận hành chương trình đánh giá nội bộ mang tên Project Lily. Tài liệu nội bộ do hãng tin này thu thập cho thấy hàng trăm lao động hợp đồng được giao đọc các hội thoại thực tế trên ChatGPT, xác định ý định của người dùng, đồng thời chấm điểm chất lượng và phát hiện vấn đề trong câu trả lời do mô hình tạo ra.
Tên tài khoản người dùng không hiển thị với người tham gia đánh giá. Tuy nhiên, trong một số trường hợp, toàn bộ nội dung hội thoại vẫn được hiển thị. Một số tác vụ còn đi kèm “bản tóm tắt bộ nhớ người dùng”, tức phần tổng hợp bối cảnh sử dụng mà ChatGPT đã ghi nhớ trước đó. Theo 404 Media, dữ liệu này có thể chứa những chi tiết giúp suy đoán danh tính, như mục đích sử dụng, mối quan tâm hoặc khu vực sinh sống tương đối.
OpenAI cho biết trước khi chuyển dữ liệu sang khâu đánh giá, hệ thống sẽ dùng bộ lọc bảo vệ quyền riêng tư (Privacy Filter) để phát hiện và che các thông tin định danh như tên, địa chỉ, email, số điện thoại và số tài khoản. Tuy vậy, ngay trong tài liệu mô tả hệ thống, công ty cũng thừa nhận bộ lọc này có thể bỏ sót các tên hiếm gặp, địa danh mang tính khu vực hoặc dữ liệu cá nhân chỉ có thể nhận diện theo ngữ cảnh.
Với người dùng ChatGPT cá nhân, trong phần Cài đặt > Kiểm soát dữ liệu, có thể tắt tùy chọn “cải thiện mô hình cho mọi người” để các cuộc trò chuyện mới không bị dùng cho việc huấn luyện mô hình. Trong khi đó, ChatGPT Business, Enterprise và Edu mặc định không sử dụng dữ liệu đầu vào và đầu ra cho mục đích huấn luyện.
Tính năng “trò chuyện tạm thời” cũng không được dùng để cải thiện mô hình. Tuy nhiên, dữ liệu vẫn có thể được lưu tối đa 30 ngày để phục vụ an toàn hệ thống và chống lạm dụng, đồng thời có thể bị xem xét trong phạm vi hạn chế khi cần thiết. OpenAI cũng khuyến cáo người dùng không nhập thông tin nhạy cảm nếu không muốn nội dung có thể bị con người xem xét.
Vụ việc một lần nữa làm nổi lên tranh luận về ranh giới giữa nhu cầu đánh giá thủ công để nâng chất lượng dịch vụ AI và yêu cầu minh bạch trong cách doanh nghiệp xử lý các hội thoại riêng tư của người dùng.