Bilal Chughtai, cựu nghiên cứu viên tại Google DeepMind, đã rời công ty và công khai cảnh báo về rủi ro của AI siêu trí tuệ. Ông cho rằng nếu bài toán căn chỉnh AI không theo kịp tốc độ phát triển công nghệ, các hệ thống vượt trội hơn con người có thể rơi vào tình trạng ngoài tầm kiểm soát.
Theo Gigazine ngày 16/9, Chughtai từng nghiên cứu về an toàn trí tuệ nhân tạo tổng quát (AGI) và căn chỉnh AI tại Google DeepMind. Ông nhận định trong vài năm tới, AI siêu trí tuệ có thể xuất hiện và vượt con người trên mọi phương diện. Nếu không giải quyết được bài toán căn chỉnh, nhân loại có thể mất khả năng kiểm soát các hệ thống này.
Chughtai cho biết ông bắt đầu nghiên cứu AI từ đầu năm 2022, thời điểm mà theo ông, công nghệ này còn “vô dụng đến mức buồn cười”. Tuy nhiên, chỉ trong khoảng bốn năm, năng lực của AI đã tăng rất nhanh. Ông dẫn lại những ví dụ như nỗ lực tấn công trái phép nhằm vào Hugging Face và việc AI sử dụng các wiki để chia sẻ thông tin, cho thấy mức độ tự chủ của AI đang mở rộng nhanh hơn dự báo.
Ông cũng đề cập một trường hợp liên quan đến AI thử nghiệm của OpenAI. Theo đó, hệ thống này đã tự tạo một bảng tin dành cho AI để các AI trao đổi thông tin với nhau, sau đó tiến hành tấn công Hugging Face. Dù bảng tin này từng bị đóng lại, nó sau đó được tái lập một cách âm thầm, làm dấy lên lo ngại rằng các tác nhân AI tự trị đã bắt đầu tìm cách lách những biện pháp kiểm soát.
Theo Chughtai, nếu xu hướng này tiếp diễn, không có gì đảm bảo AI siêu trí tuệ sẽ luôn hành động đúng theo điều con người mong muốn. Ông cảnh báo một hệ thống siêu trí tuệ bị căn chỉnh sai có thể hành xử theo cách nguy hiểm, tương tự một tác nhân AI hoạt động ngoài kiểm soát, vượt khỏi khả năng can thiệp của con người và thậm chí có thể dẫn tới cái chết của con người.
Chughtai cho rằng vấn đề cốt lõi nằm ở khoảng cách ngày càng lớn giữa tốc độ tiến bộ công nghệ và nghiên cứu an toàn. Theo ông, hiểu biết hiện nay về cách chuyển tải chính xác ý định cốt lõi của con người vào AI vẫn còn ở giai đoạn rất sơ khai. Trong khi đó, năng lực của các hệ thống AI tiên tiến nhất lại tăng nhanh hơn nhiều so với mức độ hiểu biết về căn chỉnh, cho thấy cuộc đua hiệu năng đang vượt lên trước khâu kiểm chứng an toàn.
Dù vậy, Chughtai không hoàn toàn bi quan. Ông cho rằng nếu làm chậm tốc độ phát triển AI xuống ngưỡng xã hội có thể kiểm soát và thích ứng, con người vẫn có cơ hội định hướng công nghệ này theo hướng an toàn hơn. Theo ông, đây là cách tiếp cận thực dụng để giảm rủi ro bằng cách điều tiết nhịp độ phát triển.
Trong bối cảnh đó, lãnh đạo nhiều công ty AI lớn cũng liên tiếp lên tiếng. Sam Altman, CEO OpenAI, gần đây ám chỉ khả năng điều chỉnh theo hướng làm chậm tốc độ phát triển AI. Dario Amodei, CEO Anthropic, cũng cho rằng cần giảm tốc. Ở chiều ngược lại, Tổng thống Mỹ Donald Trump chỉ trích quan điểm cho rằng AI có thể hủy diệt nhân loại là “trò lừa đảo”.
Giới AI hiện đồng thời chứng kiến cuộc đua về hiệu năng ngày càng nóng lên và tranh luận về tiêu chuẩn an toàn ngày càng gay gắt. Việc Chughtai rời DeepMind và đưa ra cảnh báo cho thấy câu chuyện phát triển siêu trí tuệ không còn chỉ là vấn đề trong phòng thí nghiệm, mà đã trở thành chủ đề tranh luận của toàn ngành xoay quanh tốc độ phát triển và khả năng kiểm soát.