Các chuyên gia an ninh của Mỹ và Trung Quốc vừa đề xuất một bộ nguyên tắc chung nhằm ngăn AI tự đưa ra quyết định tấn công vào hệ thống chỉ huy hạt nhân hoặc sử dụng vũ khí hạt nhân.
Theo Decrypt ngày 17/9, báo cáo do Viện Brookings và Đại học Fudan (Thượng Hải) công bố kêu gọi Washington và Bắc Kinh mở rộng nguyên tắc “con người kiểm soát” từ lĩnh vực hạt nhân sang các ứng dụng AI quân sự.
Trọng tâm của báo cáo là không để AI tự quyết trong các quyết định liên quan đến hệ thống chỉ huy, kiểm soát và liên lạc hạt nhân, còn gọi là NC3. Nhóm nghiên cứu cho rằng Tổng thống Mỹ Donald Trump và Chủ tịch Trung Quốc Xi Jinping có thể đạt một thỏa thuận, theo đó chỉ con người mới có quyền quyết định có phát động tấn công mạng nhằm vào NC3 hoặc hạ tầng trọng yếu của đối phương hay không.
Báo cáo nêu rõ quyết định khởi động tấn công mạng vào hệ thống chỉ huy, kiểm soát và liên lạc hạt nhân, cũng như hạ tầng trọng yếu của đối phương, phải do con người đưa ra, không phải AI.
NC3 là hệ thống phụ trách phát hiện mối đe dọa, đánh giá việc sử dụng vũ khí hạt nhân và truyền lệnh phóng. Chỉ cần một mắt xích trong chu trình này gặp trục trặc, nguy cơ gián đoạn liên lạc, nhận định sai về một cuộc tấn công, thúc đẩy đòn đánh phủ đầu hoặc phóng vũ khí ngoài ý muốn có thể xảy ra. Theo báo cáo, rủi ro cần được giảm thiểu không chỉ từ sự cố ngẫu nhiên và sai sót của con người, mà còn từ hành vi khó lường của AI và các chủ thể không được phép có thể kích hoạt một cuộc tấn công gây hệ quả chiến lược.
Nhóm nghiên cứu cho rằng việc mở rộng nguyên tắc đang áp dụng trong lĩnh vực hạt nhân sang các mảng AI quân sự khác không đồng nghĩa Mỹ và Trung Quốc phải đạt đồng thuận rộng hơn về an ninh mạng. Nói cách khác, việc thừa nhận rằng các cuộc tấn công có tác động chiến lược phải phản ánh ý chí của con người và do con người chịu trách nhiệm không buộc hai bên phải chia sẻ toàn bộ nguyên tắc an ninh mạng.
Đề xuất cũng bao gồm việc thiết lập một đường dây nóng về AI quân sự giữa hai nước, đồng thời xây dựng định nghĩa chung về khái niệm “con người kiểm soát”. Báo cáo cảnh báo tốc độ ra quyết định của AI quá nhanh, trong khi hành vi của công nghệ này lại khó dự báo. Trong kịch bản căng thẳng leo thang, lãnh đạo hai bên có thể gần như không còn đủ thời gian để can thiệp. Đặc biệt trong lĩnh vực quân sự, những quyết định tự động diễn ra trong vài mili giây có thể biến một cảnh báo sai hoặc một cuộc tấn công mạng thành khủng hoảng hạt nhân.
Lo ngại này cũng từng xuất hiện trong một cuộc mô phỏng wargame diễn ra hồi tháng 2. Các mô hình của OpenAI, Google và Anthropic đã lựa chọn sử dụng vũ khí hạt nhân trong 95% số kịch bản thử nghiệm. Tuy nhiên, giới chuyên gia cũng lưu ý chính thiết kế của mô phỏng này có thể đã đẩy mức độ căng thẳng lên cao.
Cũng trong tháng 2, Anthropic cho biết đã từ chối yêu cầu của Bộ Quốc phòng Mỹ về việc gỡ bỏ các hạn chế liên quan đến giám sát quy mô lớn bằng Claude và vũ khí tự hành hoàn toàn. Sau đó, chính quyền Trump chỉ đạo các cơ quan liên bang ngừng sử dụng công nghệ của Anthropic. Tuy vậy, ngày 28/8, một tòa án liên bang nhận định chính quyền đã có hành vi trả đũa trái pháp luật đối với công ty này.
Lời kêu gọi làm chậm nhịp phát triển AI và duy trì quyền kiểm soát của con người cũng đang lan rộng trong ngành công nghệ. Đầu tháng này, CEO Anthropic Dario Amodei đã hối thúc các nhà phát triển giảm tốc cuộc đua hiệu năng. Sam Altman và Elon Musk cũng bày tỏ sự ủng hộ. OpenAI hiện đã gửi câu hỏi lên Quốc hội về việc liệu các công ty có thể phối hợp điều chỉnh tốc độ phát triển mà không vi phạm luật chống độc quyền hay không.
Dù vậy, báo cáo lần này chỉ tập trung vào một số nguyên tắc tối thiểu có thể áp dụng ngay, trong bối cảnh chưa có một thỏa thuận diện rộng về việc hạn chế tốc độ phát triển AI. Theo nhóm nghiên cứu, quyền phê chuẩn tấn công vào hệ thống chỉ huy hạt nhân và quyết định sử dụng vũ khí hạt nhân phải luôn thuộc về con người. Báo cáo nhấn mạnh rằng quản trị AI quân sự không phải vấn đề có thể trì hoãn, mà là một cuộc chạy đua với thời gian.