Claude, dịch vụ AI của Anthropic. Ảnh: Shutterstock

Dịch vụ AI tạo sinh Claude của Anthropic vừa bị phát hiện làm lộ hàng trăm cuộc trò chuyện công khai trên Google, trong đó có nhiều thông tin nhạy cảm như cụm từ khôi phục ví tiền số (seed phrase), dữ liệu cá nhân và nội dung tư vấn pháp lý.

Theo Decrypt ngày 27/7 (giờ địa phương), tính năng tạo liên kết chia sẻ của Claude không gắn thẻ meta noindex, khiến các đường dẫn công khai vẫn có thể bị công cụ tìm kiếm lập chỉ mục và hiển thị trên Google.

Vụ việc bắt đầu thu hút chú ý từ ngày 25/7, khi một người dùng Reddit sử dụng truy vấn “site:claude.ai/share” và phát hiện hàng loạt cuộc trò chuyện chia sẻ của người khác. Dù Claude đã cảnh báo rằng “bất kỳ ai có liên kết đều có thể xem”, các công cụ tìm kiếm vẫn có thể thu thập những URL này, đồng nghĩa người dùng cũng có thể truy cập chúng thông qua tìm kiếm trên Google.

Những cuộc trò chuyện bị lộ được cho là chứa seed phrase ví tiền số, thông tin cá nhân, bao gồm cả dữ liệu được nghi là số an sinh xã hội (SSN), cùng các nội dung tư vấn pháp lý như việc có nên tự nguyện khai báo vi phạm đạo đức nghề nghiệp hay không.

Nguyên nhân trực tiếp được xác định là việc thiếu thẻ meta noindex để ngăn lập chỉ mục. Trước đó, Anthropic đã dùng tệp robots.txt để hạn chế trình thu thập dữ liệu truy cập các trang chia sẻ của Claude, nhưng biện pháp này không đủ để chặn hoàn toàn việc các liên kết xuất hiện trên công cụ tìm kiếm.

Trong tài liệu chính thức, Google cho biết nếu một URL được dẫn từ website bên ngoài, liên kết đó vẫn có thể xuất hiện trong kết quả tìm kiếm ngay cả khi Google không đọc được nội dung trang. Khi đó, kết quả có thể chỉ hiện dòng “Không có thông tin cho trang này”, nhưng liên kết vẫn tiếp tục được liệt kê.

Sự cố không chỉ dừng ở các cuộc trò chuyện chia sẻ. Decrypt cho biết các Artifacts công khai do Claude tạo ra cũng rơi vào tình trạng tương tự. Với truy vấn “claude.ai/public/artifacts”, có thể thấy cả bảng tính lương chứa tên nhân viên, nội dung trao đổi CRM nội bộ và lộ trình sản phẩm trước ngày ra mắt.

Vụ việc này cũng gợi lại sự cố mà OpenAI từng gặp phải năm ngoái. Khi đó, tính năng cho phép “biến cuộc trò chuyện này thành có thể tìm kiếm” của ChatGPT đã khiến hàng nghìn cuộc hội thoại xuất hiện trên Google, Bing và DuckDuckGo. OpenAI sau đó ngừng tính năng này, nhưng một số cuộc trò chuyện được cho là đã bị lưu trên Internet Archive và vẫn có thể truy cập.

Ngày 26/7, Anthropic đã bổ sung thẻ noindex cho các trang chia sẻ để khắc phục sự cố. Sau động thái này, các liên kết chia sẻ của Claude bắt đầu biến mất khỏi kết quả tìm kiếm trên Google.

Tuy nhiên, theo Decrypt, một số liên kết chia sẻ vẫn còn xuất hiện trên Bing của Microsoft. Tính đến thời điểm bài báo được đăng, Anthropic vẫn chưa đưa ra tuyên bố chính thức về vụ việc.

Vấn đề nằm ở chỗ những dữ liệu đã bị lộ rất khó thu hồi hoàn toàn. Một kho lưu trữ công khai có tên “Shared-Claude-Chats” được xác nhận đang lưu dưới dạng văn bản thuần 453 cuộc trò chuyện của Claude và 519 cuộc trò chuyện của Grok, tương ứng tổng cộng 11.241 tin nhắn được thu thập trước khi vụ việc bùng lên.

Người dùng hiện có thể thu hồi liên kết chia sẻ trong phần quyền riêng tư thuộc cài đặt của Claude. Tuy nhiên, thao tác này không thể xóa những dữ liệu đã bị lưu ở các kho bên ngoài hoặc các dịch vụ ghi lại lịch sử truy cập.

Sự cố cho thấy rủi ro rò rỉ dữ liệu ngoài dự kiến khi các tính năng chia sẻ của AI tạo sinh kết hợp với cơ chế lập chỉ mục của công cụ tìm kiếm. Với những thông tin đặc biệt nhạy cảm như seed phrase ví tiền số, chỉ một lần lộ lọt cũng có thể khiến người dùng mất quyền kiểm soát tài sản.

Từ khóa

#Anthropic #Claude #Google #noindex #bảo mật dữ liệu #seed phrase #Artifacts #Bing
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.