Việc Anthropic gắn watermark ẩn vào văn bản do Claude tạo ra đang làm dấy lên tranh cãi về quyền riêng tư và bản quyền. Ảnh: Reve AI

Anthropic đã bắt đầu gắn watermark ẩn vào một số văn bản do Claude tạo ra hoặc xử lý, động thái nhằm đáp ứng yêu cầu của EU AI Act nhưng đồng thời làm dấy lên tranh cãi về quyền riêng tư, bản quyền và độ chính xác trong nhận diện nội dung do AI tạo.

Theo Business Insider và một số hãng tin ngày 13/8 (giờ địa phương), Anthropic trong tuần này thông báo sẽ trực tiếp nhúng watermark khó nhận biết bằng mắt thường vào đầu ra của một số mô hình Claude. Công ty cho biết dấu này vẫn có thể tồn tại khi sao chép - dán và trong một số trường hợp vẫn còn sau khi văn bản đã được chỉnh sửa.

Anthropic giải thích đây là cách để phân biệt nội dung do con người viết với nội dung do AI tạo ra, song không công bố chi tiết kỹ thuật.

Nhà đầu tư công nghệ Bill Gurley cho rằng nếu chỉ Anthropic có thể phát hiện watermark, công ty sẽ chẳng khác nào vừa là “thẩm phán, bồi thẩm đoàn và công tố viên”. Đáp lại, Anthropic cho biết sẽ cung cấp API miễn phí để người dùng và bên thứ ba tự kiểm tra.

Một số nhà phát triển lo ngại watermark có thể ảnh hưởng đến chất lượng câu trả lời của Claude. Theo họ, nếu cơ chế đánh dấu dựa trên việc điều chỉnh cách dùng từ hoặc lối diễn đạt, văn bản có thể trở nên gượng gạo hơn. Anthropic phủ nhận lo ngại này và khẳng định watermark không làm thay đổi ý nghĩa, chất lượng hay độ dễ đọc của phản hồi.

Tranh luận cũng tập trung vào phạm vi áp dụng của watermark. Một số ý kiến cho rằng ngay cả khi người dùng chỉ nhờ Claude sửa ngữ pháp hoặc hiệu đính nhẹ văn bản do con người viết, kết quả đầu ra vẫn có thể bị nhận diện là nội dung do AI tạo.

Anthropic thừa nhận watermark không đồng nghĩa Claude là bên viết toàn bộ nội dung từ đầu. Theo công ty, dấu này chỉ cho thấy văn bản đã được Claude xử lý, vì vậy vẫn có thể xuất hiện trong các tác vụ như hiệu đính, dịch, tóm tắt hoặc chuyển đổi tệp. Nói cách khác, ngay cả khi ý tưởng, dữ liệu hay bản thảo gốc đến từ nơi khác, kết quả cuối cùng vẫn có thể mang dấu vết của Claude.

Điều này làm dấy lên thêm tranh cãi, bởi EU AI Act đã loại trừ khá rõ các thao tác chỉnh sửa nhẹ khỏi nhóm bắt buộc gắn watermark. Tuy nhiên trên thực tế, Claude vẫn có thể để lại watermark ngay cả khi chỉ can thiệp rất ít vào văn bản gốc. Nếu hệ thống không phân biệt được giữa việc tạo mới nội dung quy mô lớn với các chỉnh sửa nhỏ, cả những nội dung không thuộc diện điều chỉnh của luật cũng có thể bị đánh dấu.

Lo ngại về quyền riêng tư cũng nhanh chóng xuất hiện. Steven Sinofsky, lãnh đạo tại Microsoft, cho rằng vấn đề cốt lõi nằm ở việc lưu giữ dữ liệu và quyền được suy nghĩ riêng tư mà không để lại dấu vết số. Trong khi đó, John Crickett, người đào tạo kỹ sư phần mềm, nhận định nếu mã do AI tạo bị gắn watermark, việc chứng minh phần đóng góp của con người trong quá trình xin bảo hộ bản quyền có thể trở nên khó khăn hơn.

Watermark được áp dụng tới đâu

Anthropic cho biết việc triển khai watermark nhằm tuân thủ EU AI Act. Đạo luật này yêu cầu các nhà cung cấp hệ thống AI phải gắn watermark đối với kết quả âm thanh, hình ảnh, văn bản và video do AI tạo hoặc bị AI thao túng. Quy định áp dụng với các mô hình phát hành sau ngày 2/8, còn những mô hình ra mắt trước đó được gia hạn đến tháng 12/2026.

Công ty cũng cho biết việc áp dụng không chỉ giới hạn ở thị trường EU. Các mô hình mới được cung cấp trên phạm vi toàn cầu sẽ được tích hợp watermark ngay từ đầu. Với văn bản, Anthropic sử dụng watermark ẩn mà người dùng không thể tự nhận biết. Với các tệp đầu ra ở định dạng khác, nếu được hỗ trợ, hệ thống sẽ đính kèm siêu dữ liệu nguồn gốc có chữ ký số.

Đối với nội dung phi văn bản, Anthropic áp dụng chuẩn siêu dữ liệu C2PA, song lưu ý rằng một số nền tảng hoặc tính năng có thể không hỗ trợ watermark. Với các mô hình đủ điều kiện, watermark đã được triển khai trên toàn cầu từ ngày 2/8.

Trên thị trường, nhiều công ty công nghệ cũng đang theo đuổi các biện pháp tương tự. Google dùng SynthID cho nội dung tạo sinh, còn OpenAI được cho là cũng sử dụng SynthID cho một số nội dung hình ảnh và âm thanh được hỗ trợ. X, trước đây là Twitter, gắn nhãn “Made with AI” với các nội dung bị đánh giá là do AI tạo hoặc chỉnh sửa. Nhãn này từng xuất hiện rồi biến mất trên bài đăng thông báo từ chức của người phát ngôn Nhà Trắng Karoline Leavitt ngày 13/8.

Một số ý kiến ủng hộ watermark vì cho rằng công cụ này có thể giúp hạn chế tình trạng các hệ thống AI tiếp tục học lại chính nội dung do mình tạo ra, từ đó làm suy giảm hiệu năng mô hình.

Dù vậy, hiệu quả thực tế của watermark vẫn bị đặt dấu hỏi. Với văn bản, watermark được cho là hoạt động bằng cách tạo ra những sai lệch rất nhỏ trong mẫu lựa chọn từ ngữ trên toàn văn bản và chỉ có thể được phát hiện bằng công cụ chuyên dụng. Cách làm này có thể khiến mô hình ưu tiên giữ tín hiệu watermark thay vì chọn lối diễn đạt tự nhiên nhất.

Ngay cả khi văn bản đã được gắn watermark, dấu này vẫn có thể biến mất nếu nội dung được dán sang một chatbot khác rồi tiếp tục chỉnh sửa. Với hình ảnh hoặc video, watermark cũng có thể bị loại bỏ bằng cách chụp màn hình, ghi hình hoặc sử dụng các công cụ chỉnh sửa siêu dữ liệu phổ biến. Một số ý kiến cho rằng nếu Anthropic công khai hoàn toàn cơ chế nhận diện, việc phát triển công cụ gỡ watermark ngược cũng không quá khó.

Watermark truyền tải rất ít thông tin

Một vấn đề khác là lượng thông tin mà watermark cung cấp khá hạn chế. Anthropic cho biết tín hiệu được phát hiện chỉ cho thấy nội dung đã được Claude xử lý, chứ không phải bằng chứng kết luận rằng toàn bộ văn bản do Claude tạo ra.

Điều đó có nghĩa watermark có thể xuất hiện cả trên những nội dung không do Claude viết từ đầu. Ngược lại, Anthropic cũng nhấn mạnh rằng việc không phát hiện thấy watermark không đồng nghĩa nội dung đó chắc chắn không được AI tạo hoặc xử lý.

Nếu người đọc phổ thông không phân biệt được giữa “văn bản đã được AI xử lý” và “văn bản hoàn toàn do AI tạo”, những bài viết do con người soạn nhưng chỉ qua biên tập nhẹ bằng AI cũng có thể bị nhìn nhận như nội dung tạo sinh hoàn toàn.

EU AI Act còn có một quy định khác tại khoản 4 Điều 50, liên quan đến nghĩa vụ gắn nhãn công khai cho người dùng. Theo điều khoản này, ngay cả văn bản hoàn toàn do AI viết ra cũng thường không bắt buộc phải gắn nhãn riêng; chẳng hạn tiểu thuyết hoặc nội dung marketing do AI tạo có thể không cần dán nhãn.

Tuy nhiên, nếu nội dung được dùng để “thông tin tới công chúng về vấn đề vì lợi ích công” và không được một biên tập viên có trách nhiệm rà soát, nội dung đó phải được gắn nhãn. Vì vậy có thể xảy ra nghịch lý: ở cấp độ mô hình, gần như mọi nội dung “được xử lý” đều có thể mang watermark, nhưng ở khâu công bố ra công chúng, một số nội dung do AI viết vẫn không cần nhãn nếu đã qua biên tập.

EU cho biết các yêu cầu về minh bạch được đặt ra nhằm ngăn nguy cơ làm xói mòn niềm tin vào hệ sinh thái thông tin, đồng thời hạn chế các rủi ro mới như thông tin sai lệch, thao túng trên diện rộng, lừa đảo, mạo danh và đánh lừa người tiêu dùng. Hướng dẫn của Ủy ban châu Âu nêu rõ người dùng cần biết khi nào họ đang tương tác với AI hoặc tiếp xúc với nội dung do AI tạo ra, từ đó có cơ sở điều chỉnh mức độ tin cậy và phụ thuộc vào công nghệ này.

Dù vậy, thực tế rằng một số bài viết do AI tạo về các vấn đề công ích vẫn có thể không phải gắn nhãn cho độc giả nếu đã qua biên tập tiếp tục khiến nhiều ý kiến cho rằng vẫn còn khoảng cách giữa mục tiêu chính sách và cách triển khai.

Anthropic cho biết sẽ tiếp tục hoàn thiện watermark và công nghệ phát hiện để đáp ứng yêu cầu của EU. Theo EU AI Act, nếu các biện pháp liên quan không hoạt động đúng như quy định, doanh nghiệp có thể bị phạt tới 15 triệu euro hoặc 3% doanh thu toàn cầu hằng năm, tùy theo mức nào cao hơn.

Từ khóa

#Anthropic #Claude #watermark ẩn #EU AI Act #quyền riêng tư #bản quyền #API #C2PA #SynthID
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.