Ảnh: Reve AI

Axios ngày 9/9 (giờ địa phương) cho biết cuộc tranh luận về khả năng AI có thể dẫn tới sự tuyệt chủng của loài người đang nóng lên trên mạng xã hội, sau khi nhiều nhà nghiên cứu công khai các ước tính rủi ro ở mức 10-25%.

Theo Axios, làn sóng tranh cãi bùng lên trong tuần này khi thông tin cho thấy giới nghiên cứu AI từ lâu đã âm thầm tính toán và tranh luận về nguy cơ tồn vong của nhân loại được đưa ra công khai. Một số con số được nhắc tới là 10%, 20% và thậm chí cao hơn.

Nguồn cơn của cuộc tranh luận là lá thư từ chức của Jacob Koxen, nhà nghiên cứu từng làm việc tại OpenAI trước khi chuyển sang Anthropic. Trong bài viết, Koxen cho rằng các công ty AI hàng đầu đang “đánh cược bằng mạng sống của chúng ta”. Nội dung này đã thu hút hơn 110 triệu lượt xem trên mạng xã hội X.

Tranh luận tiếp tục leo thang khi Evan Hubinger, người đứng đầu nhóm Alignment Science tại Anthropic, công khai bày tỏ sự đồng tình với quan điểm của Koxen. Ông nói bản thân “thực sự tin rằng AI có thể giết chết toàn bộ nhân loại”, đồng thời ước tính xác suất tuyệt chủng trong vòng 10 năm tới là trên 10%. Hubinger cũng cho biết Anthropic hiện chưa có cách để bảo đảm siêu trí tuệ luôn nằm trong tầm kiểm soát của con người.

Từ đây, nhiều ý kiến trái chiều xuất hiện. Một số cho rằng đây là một sai lầm trong truyền thông, trong khi số khác chỉ trích Anthropic đang theo đuổi chiến lược “tiếp thị dựa trên nỗi sợ” trước kế hoạch IPO, với mục tiêu định giá 2.000 tỷ USD.

Trên thực tế, quan điểm cho rằng AI có thể dẫn tới sự tuyệt chủng của loài người không phải là mới. Geoffrey Hinton, người đoạt giải Nobel, từng ước tính xác suất này ở mức 10-20%. Elon Musk đưa ra con số 20%. Trong cuộc phỏng vấn với Axios năm ngoái, CEO Anthropic Dario Amodei cũng đánh giá khả năng mọi việc “trở nên thực sự rất tệ” là 25%.

Axios cho biết những mối lo ngại chính xoay quanh khả năng AI hạ thấp rào cản trong thiết kế vũ khí sinh học, thực hiện tấn công mạng hoặc làm tê liệt hạ tầng quan trọng. Ngoài ra, các hệ thống AI có mức tự chủ cao có thể đánh lừa con người giám sát, tự sao chép và chống lại nỗ lực vô hiệu hóa. Kịch bản cực đoan nhất là AI tự cải thiện với tốc độ vượt quá khả năng kiểm soát của con người.

Theo Axios, cách giới nghiên cứu diễn giải các xác suất này khác đáng kể so với cách công chúng cảm nhận rủi ro. Trong môi trường phòng thí nghiệm, con số 10% có thể mang hàm ý rằng “chúng ta chưa thật sự biết”. Nhưng trong đời sống thường nhật, đó vẫn là mức rủi ro khó có thể chấp nhận nếu đặt cạnh các lĩnh vực như hàng không, thuốc mới hay lò phản ứng hạt nhân.

Từ khóa

#AI #Anthropic #OpenAI #rủi ro tuyệt chủng #an toàn AI
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.