Claude của Anthropic. Ảnh: Shutterstock

Anthropic đang triển khai watermark “vô hình” cho văn bản do mô hình tạo sinh Claude tạo ra, nhằm hỗ trợ nhận diện các nội dung AI được nộp hoặc xuất bản như do con người viết. Động thái này có thể ảnh hưởng tới cách các trường học, nhà xuất bản và tổ chức bên ngoài xác minh việc sử dụng AI.

Ngày 11/8 (giờ địa phương), Business Insider đưa tin Anthropic cho biết sẽ chèn “watermark gần như không thể nhận biết bằng mắt thường” vào văn bản do các phiên bản Claude mới phát hành từ ngày này tạo ra.

Theo Anthropic, watermark không làm thay đổi ý nghĩa hay khả năng đọc của văn bản. Dấu nhận diện này cũng được thiết kế để vẫn được giữ lại khi người dùng sao chép, dán nội dung sang nơi khác. Công ty cho biết watermark vẫn có thể tồn tại ngay cả khi văn bản đã được chỉnh sửa ở một mức độ nhất định.

Tính năng này áp dụng cho các mô hình Claude ra mắt sau ngày 2/8. Anthropic cho biết các mô hình đó đã hỗ trợ watermark văn bản ngay từ khi phát hành, đồng thời công ty đang mở rộng tính năng sang các mô hình cũ.

Watermark không chỉ áp dụng với người dùng sử dụng trực tiếp Claude, mà còn với các trường hợp truy cập mô hình này thông qua nhà cung cấp dịch vụ đám mây. Anthropic cũng cho biết sẽ cung cấp thêm công cụ phát hiện cho bên thứ ba, để các tổ chức bên ngoài có thể kiểm tra liệu một nội dung có phải do AI tạo ra hay không.

Theo Business Insider, biện pháp này cũng phù hợp với xu hướng tăng cường minh bạch theo Đạo luật AI của Liên minh châu Âu. Mục tiêu là giúp việc xác định nguồn gốc nội dung do AI tạo ra trở nên dễ dàng hơn, qua đó hỗ trợ người dùng và các bên liên quan đánh giá liệu AI có được sử dụng hay không.

Với các nhà xuất bản, trường học và đại học, đây có thể trở thành một công cụ mới để xác minh văn bản do AI tạo ra. Thời gian gần đây, hàng loạt tranh cãi liên quan đến nghi vấn sử dụng AI trong xuất bản đã khiến câu hỏi về quy trình tạo tác phẩm và mức độ can thiệp của AI trở thành tâm điểm chú ý.

Tháng trước, tiểu thuyết trinh thám “Call Me, I'll Hide the Body” vướng nghi vấn tác giả có thể đã sử dụng AI, khiến người đại diện rút lại hỗ trợ. Tranh cãi bùng lên sau khi 14 nhà xuất bản tham gia cuộc đấu giá bản quyền và thậm chí đã ký hợp đồng. Tác giả Jerry Pallade phủ nhận việc viết cuốn tiểu thuyết bằng AI.

Đầu năm nay, tiểu thuyết kinh dị “Shy Girl” cũng gây tranh cãi vì một số câu chữ bị cho là do AI tạo ra. Tác giả Mia Vollard khẳng định không sử dụng AI và cho rằng một biên tập viên tự do đã chèn những câu do AI tạo mà không có sự đồng ý của cô.

Trong bối cảnh các vụ việc tương tự tiếp diễn, watermark văn bản có thể trở thành một căn cứ bổ sung để nhà xuất bản tham chiếu khi xác minh bản thảo có sử dụng AI hay không. Trong môi trường giáo dục, công cụ này cũng có thể được dùng để kiểm tra việc AI có xuất hiện trong bài tập của học sinh, sinh viên hay không.

Tuy nhiên, watermark không phải công cụ nhận diện tuyệt đối. Anthropic thừa nhận dấu này có thể không còn được phát hiện nếu văn bản bị sửa đổi quá nhiều, được viết lại, dịch sang ngôn ngữ khác hoặc trộn với các đoạn văn bản khác. Ngoài ra, việc phát hiện watermark cũng không đồng nghĩa Claude đã viết toàn bộ nội dung. Dấu này có thể xuất hiện ngay cả khi Claude chỉ được dùng để hiệu đính hoặc dịch một văn bản do con người viết.

Anthropic là hãng AI lớn thứ hai triển khai watermark cho văn bản. Trước đó, Google DeepMind cho biết trong năm 2024 sẽ áp dụng watermark dựa trên SynthID cho văn bản và video được tạo trên ứng dụng và web Gemini. Công nghệ watermark cho hình ảnh đã được cung cấp từ năm 2023.

Động thái của Anthropic được xem là bước thiết lập một lớp công cụ kỹ thuật tối thiểu để truy vết nguồn gốc văn bản do AI tạo ra. Dù watermark không thể được dùng để khẳng định chắc chắn việc có sử dụng AI hay không, sự xuất hiện của thêm một công cụ xác minh mới bên cạnh các phương thức phát hiện hiện có có thể tiếp tục làm nóng tranh luận về tính minh bạch trong nội dung do AI hỗ trợ tạo ra và việc xác thực tác phẩm.

Từ khóa

#Anthropic #Claude #AI #watermark văn bản #xuất bản #giáo dục #EU AI Act
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.