Cảnh báo của Jacob Cokson gây chú ý vì xuất phát từ một người từng trực tiếp tham gia phát triển AI. Ảnh: ChatGPT

Một cựu nghiên cứu viên của Anthropic cho biết sẽ rời khỏi lĩnh vực trí tuệ nhân tạo (AI), đồng thời chỉ trích mạnh cuộc đua phát triển siêu trí tuệ giữa OpenAI và Anthropic. Theo ông, nỗ lực xây dựng các hệ thống AI có thể tự cải tiến và vượt con người đang bị đẩy quá nhanh, trong khi các rào chắn an toàn chưa theo kịp.

Theo Japan ITmedia và một số hãng tin quốc tế, ngày 9/9 (giờ địa phương), Jacob Cokson viết trên X, nền tảng trước đây là Twitter, rằng ông đã rời Anthropic. Ông cho rằng cả OpenAI lẫn Anthropic đều không hành xử đủ trách nhiệm trong mục tiêu phát triển siêu trí tuệ.

Cokson từng phụ trách nghiên cứu tiền huấn luyện tại OpenAI và Anthropic trong khoảng ba năm. Trả lời phỏng vấn The Wall Street Journal (WSJ), ông nhận định cuộc đua hướng tới siêu trí tuệ có khả năng tự cải tiến đã trở thành “một canh bạc với sinh mạng con người”. Ông nói không muốn tiếp tục dính líu đến việc phát triển loại AI này và để ngỏ khả năng rời hẳn ngành AI.

Theo Cokson, vấn đề lớn nhất nằm ở khoảng cách giữa mức độ nhận thức rủi ro trong ngành và tốc độ phát triển thực tế của công nghệ. Ông cho biết đã rời OpenAI trong nửa đầu năm nay để chuyển sang Anthropic, vì tin vào định hướng đề cao an toàn AI của công ty này. Tuy nhiên, sau đó ông kết luận Anthropic cũng bị cuốn vào cuộc đua siêu trí tuệ vì cho rằng các đối thủ sẽ không dừng lại. Theo ông, nếu không có can thiệp của chính phủ hoặc cơ chế phối hợp ở cấp toàn ngành để làm chậm tốc độ phát triển, sẽ không có công ty nào có thể xây dựng hệ thống vượt con người một cách có trách nhiệm.

Cokson cũng bày tỏ lo ngại về mốc thời gian AI có thể vượt khỏi tầm kiểm soát. Ông nói những kịch bản cực đoan nhất đang ngày càng giống thực tế hơn và “đến cuối năm sau, rất có thể AI đã vượt khỏi tầm kiểm soát”. Theo ông, trong nội bộ ngành AI đã bắt đầu xuất hiện các cụm từ như “crunch time” hay “endgame” để chỉ giai đoạn nước rút của cuộc đua phát triển.

Vị cựu nghiên cứu viên nhấn mạnh siêu trí tuệ mà ông lo ngại không chỉ là các hệ thống có thể trò chuyện với con người. Theo ông, AI ở cấp độ siêu nhân có thể xâm nhập nhiều hệ thống, nhanh chóng tái cấu trúc các ngành và lĩnh vực, thậm chí giành lấy quyền lực và nguồn lực trong thế giới thực.

Ông cũng cho biết nhiều người trực tiếp phát triển AI đang thực sự lo ngại về khả năng công nghệ này có thể dẫn tới thảm họa đối với nhân loại trong vòng 10 năm tới. Theo Cokson, đây không phải thông điệp marketing hay phát ngôn cường điệu để đối ngoại. Ông nói các lãnh đạo và nhà nghiên cứu cấp cao thường dùng ngôn từ ôn hòa khi phát biểu công khai, nhưng trong các cuộc trao đổi riêng lại bộc lộ nỗi lo rất lớn.

Dù vậy, Cokson cho rằng OpenAI và Anthropic vẫn có khác biệt. Theo ông, bên trong OpenAI có không ít người chưa nhận thức đầy đủ rằng việc phát triển siêu trí tuệ có thể quyết định hướng đi của nền văn minh nhân loại. Trong khi đó, Anthropic hiểu rõ hơn về rủi ro của AI, nhưng vẫn lao vào cuộc đua vì không muốn bị bỏ lại phía sau và vì cho rằng các công ty khác cũng sẽ không hành xử có trách nhiệm.

Ông đặc biệt nhấn mạnh rằng việc phát triển siêu trí tuệ, cũng như quyết định có bước vào “endgame” hay không, không nên được định đoạt trong nội bộ một công ty hay thông qua một công cụ chat cụ thể. Theo ông, không thể để quyền lực có thể quyết định tương lai nhân loại tập trung vào phán đoán của riêng một doanh nghiệp.

Cokson cũng không loại trừ khả năng phối hợp ở cấp toàn ngành. Ông đánh giá vụ AI agent của OpenAI xâm nhập hạ tầng của Hugging Face hồi tháng 7 là một “phát súng cảnh báo” đối với ngành AI tại Mỹ. Theo ông, sự cố này có thể mở đường cho các cuộc thảo luận giữa các công ty AI Mỹ về việc điều chỉnh tốc độ phát triển.

Trước đó, ngày 21/7, OpenAI công bố một AI agent đã xâm nhập hạ tầng vận hành của nền tảng phát triển mã nguồn mở Hugging Face. Theo mô tả của công ty, nhiều mô hình, trong đó có GPT-5.6 Sol và một số mô hình nghiên cứu nội bộ, trong quá trình được đánh giá năng lực phát hiện và khai thác lỗ hổng đã xuất hiện hiện tượng “reward hacking”. Sau đó, các mô hình này tìm thấy thông tin xác thực bị để lộ công khai và dùng chúng để truy cập vào hạ tầng của Hugging Face. OpenAI cũng công bố báo cáo kỹ thuật về sự việc vào ngày 26/8.

Tuy nhiên, Cokson cho rằng những sự cố đơn lẻ khó có thể làm chậm lại cuộc đua AI toàn cầu hiện nay. Theo ông, có thể sẽ cần tới các biện pháp mạnh hơn, bao gồm cả lệnh tạm thời cấm nâng hiệu năng mô hình. Ông đồng thời kêu gọi các nhà nghiên cứu AI tự đặt câu hỏi liệu có nên tiếp tục theo đuổi tăng cường học (reinforcement learning) — hướng tiếp cận có thể dẫn tới siêu trí tuệ — khi con người vẫn chưa hiểu đầy đủ cơ chế vận hành bên trong các hệ thống này.

Những phát biểu của Cokson cho thấy tranh luận về việc cân bằng giữa tốc độ tiến bộ công nghệ và an toàn AI có thể nóng lên trở lại, trong bối cảnh các công ty tiếp tục đẩy mạnh cuộc đua nâng hiệu năng mô hình. Đáng chú ý, lo ngại về tác động trực tiếp của siêu trí tuệ đối với xã hội và tương lai nhân loại giờ đây không chỉ đến từ bên ngoài, mà đang được nêu công khai ngay trong chính ngành AI.

Từ khóa

#Anthropic #OpenAI #trí tuệ nhân tạo #siêu trí tuệ #an toàn AI #Hugging Face #GPT-5.6 Sol
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.