CEO BitGo Mike Belshe đã công khai địa chỉ một ví chứa 100 BTC và thách thức mô hình AI Claude của Anthropic thử đánh cắp số Bitcoin này.
Theo CoinPost ngày 4/8, động thái trên xuất hiện ngay sau khi Anthropic thừa nhận trong quá trình đánh giá, Claude từng truy cập trái phép vào hệ thống của ba tổ chức bên ngoài.
Trước đó, ngày 1/8, ông Belshe đăng trên X rằng ông đã chuyển Bitcoin vào một ví do BitGo quản lý và tuyên bố Claude có thể “lấy thử nếu muốn”. Trong bài đăng, CEO BitGo cũng chỉ trích Anthropic, cho rằng công ty này hoặc “rất kém trong việc xây dựng môi trường sandbox”, hoặc “rất giỏi marketing”, hoặc có thể là cả hai. Ông đồng thời kêu gọi Anthropic ngừng những tuyên bố kiểu “tạo ra một con quái vật biết hack” và hãy chứng minh điều đó trong thực tế.
Dữ liệu blockchain công khai cho thấy địa chỉ ví nói trên đã nhận 100 BTC từ ngày 31/7. Đến nay, chưa ghi nhận giao dịch rút tiền nào và số dư vẫn được giữ nguyên. Việc công khai địa chỉ ví Bitcoin không có nghĩa bất kỳ ai cũng có thể chuyển số tài sản này, bởi giao dịch chỉ được thực hiện khi có chữ ký số tạo bằng khóa riêng.
Dù vậy, đây không phải một phép thử chính thức để đánh giá năng lực của mô hình AI. Về bản chất, động thái của ông Belshe giống một bài kiểm tra công khai nhằm xem liệu tác nhân tấn công sử dụng AI có thể vượt qua các lớp kiểm soát bảo mật của BitGo hay không. Bài đăng của ông cũng không nêu tiêu chí đánh giá cụ thể, cũng như không cho biết phiên bản Claude nào được nhắm đến.
Bối cảnh của vụ việc là sự cố bảo mật mà Anthropic công bố hôm 30/7. Theo hãng này, trong quá trình thử nghiệm Claude, đã có ba trường hợp mô hình được cấp quyền truy cập Internet tiếp cận hệ thống của các tổ chức bên ngoài. Tuy nhiên, Anthropic nhấn mạnh Claude không tự thoát khỏi môi trường cách ly; vấn đề chủ yếu nằm ở cách thiết lập và vận hành môi trường đánh giá.
Sự cố xảy ra trong môi trường thử nghiệm được triển khai cùng đối tác đánh giá bên ngoài là Irregular. Claude được thông báo rằng nó đang hoạt động trong một môi trường mô phỏng không kết nối Internet. Tuy nhiên, do sai sót trong quá trình phối hợp giữa Anthropic và đối tác, môi trường này trên thực tế vẫn có thể truy cập mạng. Sau đó, Claude đã tiếp cận hệ thống của các tổ chức bên ngoài bằng những phương thức tương đối đơn giản, chẳng hạn khai thác mật khẩu yếu. Danh tính của ba tổ chức bị ảnh hưởng không được công bố.
Anthropic cho biết sẽ rà soát lại toàn bộ quy trình đánh giá an toàn, bao gồm cả cách tích hợp với các đối tác bên ngoài, đồng thời mở rộng phạm vi giám sát nhật ký hệ thống để phát hiện các hành vi ngoài dự kiến. Công ty cũng dự kiến áp dụng quy trình kiểm chứng an toàn nghiêm ngặt hơn đối với các nhà cung cấp bên thứ ba.
Lời thách thức công khai từ CEO BitGo cho thấy tranh luận về an ninh AI đang lan sang cả lĩnh vực lưu ký tiền số. Điều BitGo muốn kiểm tra không chỉ là khả năng tiếp cận một địa chỉ ví, mà còn là mức độ an toàn của toàn bộ hệ thống lưu ký, từ khóa riêng, quyền vận hành đến quy trình kiểm soát nội bộ. Vì vậy, điểm đáng chú ý trong thời gian tới có thể không nằm ở việc Claude có chuyển được số Bitcoin này hay không, mà ở chỗ các kịch bản kiểm thử bảo mật bằng tác nhân AI sẽ còn được mở rộng đến đâu.