Giáo sư Geoffrey Hinton, nhà khoa học từng được trao Nobel Vật lý và thường được gọi là “bố già AI”, cho rằng ước tính trí tuệ nhân tạo có 10% khả năng dẫn tới sự hủy diệt của loài người không phải là nhận định phi lý. Ông cũng cảnh báo mốc rủi ro này có thể đến trong vòng 10 năm, thậm chí sớm hơn.
Theo Business Insider ngày 10/9 (giờ địa phương), trong cuộc phỏng vấn với BBC, Hinton nói rất khó đưa ra xác suất chính xác về khả năng AI xóa sổ con người. Tuy nhiên, theo ông, con số 10% không phải là một suy đoán quá đà.
Hinton lập luận rằng AI là công nghệ có thể trở nên thông minh hơn con người, trong khi xã hội chưa từng phải đối mặt với một công nghệ như vậy. Vì thế, việc đánh giá rủi ro một cách chính xác là rất khó. Ông cho rằng nếu xem xác suất này chỉ ở mức 1%, đó cũng có thể là một cách nhìn quá ngây thơ. Dù vậy, ông thừa nhận hiện chưa ai thực sự biết cách đưa ra một ước tính hợp lý.
Đáng chú ý, Hinton tiếp tục rút ngắn dự báo về thời điểm rủi ro có thể xảy ra. Trước đây, ông từng cho rằng kịch bản thảm họa có thể xuất hiện sau 30-50 năm, sau đó giảm xuống 10-20 năm. Hiện nay, ông đánh giá mốc này còn khoảng 10 năm, thậm chí có thể đến sớm hơn. Trong số các rủi ro được Hinton nhắc tới có tấn công mạng và khả năng AI hỗ trợ phát triển các loại virus chết người.
Cảnh báo của Hinton cũng xuất hiện trong bối cảnh ngày càng nhiều ý kiến tương tự được đưa ra từ những người từng làm việc tại Anthropic. Jacob Coxon, người từng tham gia nghiên cứu tiền huấn luyện tại OpenAI và Anthropic, sau khi rời Anthropic đã chỉ trích rằng “cả hai công ty đều không hành động một cách có trách nhiệm”.
Trên X, nền tảng trước đây là Twitter, Coxon viết rằng “các công ty AI đang lao về phía siêu trí tuệ tự cải thiện và đang đánh cược mạng sống của chúng ta”. Ông cũng cho biết “ngay cả những người xây dựng AI cũng thực sự tin rằng trong vòng 10 năm, AI có thể giết chết loài người”.
Evan Hubinger, trưởng nhóm khoa học căn chỉnh tại Anthropic, cũng từng công khai bày tỏ quan điểm tương tự. Ông cho biết bản thân nghiêm túc xem xét khả năng AI có thể giết toàn bộ loài người, đồng thời cho rằng xác suất kịch bản đó xảy ra trong 10 năm tới là trên 10%. Dù vậy, Anthropic trước đây vẫn khẳng định rủi ro từ các mô hình hiện tại là thấp, và cho rằng điểm mấu chốt nằm ở khả năng siêu trí tuệ có thể xuất hiện thông qua quá trình tự cải thiện đệ quy.
Tự cải thiện đệ quy là kịch bản giả định trong đó AI tự thiết kế và huấn luyện các mô hình kế tiếp tốt hơn chính nó, từ đó đẩy nhanh tốc độ phát triển. Việc các công ty AI lớn rót hàng tỷ USD để mở rộng mô hình, cùng với mức cải thiện hiệu năng ngày càng lớn giữa các phiên bản mới chỉ cách nhau vài tháng, đang làm gia tăng lo ngại. Tuy nhiên, Hinton không nêu rõ lý do cụ thể khiến ông tiếp tục rút ngắn dự báo về mốc thời gian rủi ro.
Một diễn biến dễ nhận thấy trong ngành là cuộc đua công nghệ đang tăng tốc nhanh hơn các cuộc thảo luận về an toàn AI. Thời điểm Coxon rời công ty cũng trùng với giai đoạn kỳ vọng về khả năng IPO của Anthropic gia tăng. Việc các nhà nghiên cứu nội bộ và bộ phận an toàn công khai nhắc tới rủi ro tuyệt chủng cho thấy chiến lược tăng trưởng và năng lực kiểm soát an toàn của các công ty AI đang bị đặt dưới sức ép giám sát lớn hơn.
Hinton một lần nữa nhấn mạnh nhu cầu hợp tác quốc tế. Theo ông, trong nỗ lực ngăn AI thay thế con người hoặc giành quyền kiểm soát, lợi ích của các quốc gia về cơ bản là tương đồng và cuối cùng họ sẽ phải hợp tác. Tuy nhiên, câu hỏi then chốt vẫn là liệu sự hợp tác đó có đến đủ sớm hay không. Khi cuộc đua AI tiếp tục tăng tốc hướng tới siêu trí tuệ, khả năng các quy định và tiêu chuẩn an toàn bắt kịp thực tế phát triển công nghệ sẽ tiếp tục là tâm điểm chú ý.