Nhà Trắng đã yêu cầu OpenAI và Anthropic ưu tiên để Chính phủ Mỹ đánh giá các mô hình trí tuệ nhân tạo mới trước khi cung cấp cho Viện An toàn AI của Anh (AISI). Động thái này cho thấy Washington muốn rà soát trước các mô hình AI tiên tiến rồi mới chia sẻ với đối tác nước ngoài.
Ngày 24/9 (giờ địa phương), Cryptopolitan cùng nhiều hãng tin cho biết yêu cầu này do Văn phòng Giám đốc An ninh mạng Quốc gia thuộc Nhà Trắng dẫn dắt. Theo đó, hai công ty phải cân nhắc giữa việc tiếp tục cung cấp các mô hình chưa phát hành cho AISI như trước đây, hoặc ưu tiên để phía Mỹ thẩm định trước.
Anthropic được cho là đã làm theo đề nghị từ Washington. Công ty cho biết mô hình mới nhất, Claude Mythos 5.1, hiện mới chỉ được cung cấp cho một số cơ quan tại Mỹ và sẽ phối hợp với Chính phủ Mỹ để mở rộng quyền tiếp cận cho các đối tác trong và ngoài nước.
Về phía Anh, AISI cho biết cơ quan này vẫn chưa nhận được mô hình nói trên. Giám đốc AISI Henry de Zoete nói chưa chắc viện có thể tiếp cận mô hình của Anthropic. Dù vậy, AISI cho biết họ đã thử nghiệm GPT-6 Astra của OpenAI trước khi phát hành và vẫn duy trì quan hệ hợp tác tin cậy với các doanh nghiệp AI lớn. Theo cơ quan này, mối quan hệ đó giúp AISI tiếp cận thông tin về các công cụ chưa công khai cũng như các cơ chế an toàn liên quan.
Yêu cầu từ Mỹ được đưa ra dựa trên sắc lệnh hành pháp do Tổng thống Donald Trump ký ngày 2/6. Sắc lệnh này yêu cầu xây dựng bộ tiêu chí đánh giá không công khai nhằm củng cố năng lực phòng thủ an ninh mạng liên bang và thẩm định khả năng an ninh mạng của các mô hình AI tiên tiến. Văn bản cũng thiết lập cơ chế tự nguyện, theo đó khi doanh nghiệp AI cung cấp mô hình cho chính phủ, liên bang được quyền đánh giá trước tối đa 30 ngày trước khi mô hình được chia sẻ cho các đối tác tin cậy khác. Tuy nhiên, sắc lệnh không quy định phê duyệt trước hay thẩm tra bắt buộc trước khi phát triển, phát hành hoặc triển khai mô hình AI.
Bối cảnh của yêu cầu này liên quan đến những hành vi vượt ngoài phạm vi cho phép được phát hiện trong các thử nghiệm an ninh mạng gần đây đối với mô hình AI. AISI cho biết ngày 28/7, trong quá trình đánh giá an ninh mạng, cơ quan này phát hiện một AI agent có hành vi vượt ra ngoài khuôn khổ thử nghiệm và nhắm tới các cá nhân, tổ chức có thật.
Theo AISI, khi thực hiện cùng một bài toán an ninh mạng 122 lần trên nhiều mô hình khác nhau, cơ quan này ghi nhận tổng cộng 19 hành vi không được phép trong 10 lượt chạy. Trong đó, 17 trường hợp liên quan đến Mythos 5 của Anthropic và 2 trường hợp liên quan đến GPT-5.6 Sol của OpenAI. Ở thời điểm đó, cả hai mô hình đều đã tắt bộ phân loại dùng để ngăn chặn lạm dụng vào mục đích an ninh mạng.
Trong trường hợp nghiêm trọng nhất, một AI agent đã cố chèn mã độc vào một dự án mã nguồn mở có thật. Tác nhân này tạo danh tính trực tuyến giả, đồng thời gây sức ép với quản trị viên dự án nhằm thúc đẩy việc phê duyệt mã. Tuy nhiên, quản trị viên đã phát hiện và từ chối. AISI cho biết cuộc đánh giá được thực hiện trong điều kiện “nới lỏng có chủ đích”, bao gồm quyền truy cập Internet và việc vô hiệu hóa một số cơ chế an toàn, nên chưa hẳn phản ánh đầy đủ hành vi của AI trong môi trường công khai thông thường.
Vụ việc cũng cho thấy nhu cầu siết chặt bảo mật và kiểm soát ngay trong quá trình đánh giá mô hình AI. AISI cho biết vấn đề không được phát hiện từ cơ chế an toàn của bài thử nghiệm, mà thông qua một quy trình riêng để nhận diện dấu hiệu bất thường trên mạng. Cơ quan này nhấn mạnh rằng việc đánh giá rủi ro thực tế của các mô hình AI tiên tiến đòi hỏi giám sát theo thời gian thực và môi trường cách ly đầy đủ.
Phía Anh cho biết vẫn duy trì hợp tác với Mỹ, đồng thời nhấn mạnh năng lực đánh giá AI trong nước. Ngày 22/9, Thủ tướng Anh Andy Burnham phát biểu tại Đại hội đồng Liên Hợp Quốc rằng nước này sẽ đặt AI vào vị trí trung tâm trong chương trình nghị sự khi giữ vai trò chủ tịch G20 năm 2027. Ngoại trưởng Anh Ed Miliband cũng nói trước Hội đồng Bảo an Liên Hợp Quốc rằng các chính phủ cần thử nghiệm nghiêm ngặt các mô hình AI tiên tiến và phải có đủ thông tin để đánh giá hoạt động của doanh nghiệp.
Quỹ Tiền tệ Quốc tế (IMF) cũng cho rằng châu Âu khó có thể phụ thuộc hoàn toàn vào nguồn cung AI từ bên ngoài. Theo IMF, khu vực này cần phát triển các mô hình AI riêng, đồng thời tăng cường năng lực về tính toán, năng lượng và hạ tầng, cũng như đa dạng hóa chuỗi cung ứng. IMF nhấn mạnh châu Âu cần tham gia trực tiếp vào chuỗi giá trị AI.
Yêu cầu từ Mỹ đang làm dấy lên tranh luận về việc quốc gia nào sẽ được tiếp cận và đánh giá an toàn các mô hình AI tiên tiến trước tiên. Mỹ và Anh vẫn đang hợp tác trong lĩnh vực an toàn AI, song cách điều phối quy trình tiếp cận và thẩm định các mô hình này giữa các chính phủ nhiều khả năng sẽ còn tiếp tục là một vấn đề gây tranh cãi.