David Robinson, người từng phụ trách các báo cáo an toàn cho nhiều sản phẩm chủ lực của OpenAI, đã rời công ty sau 3 năm rưỡi gắn bó và công khai chỉ trích cách tiếp cận an toàn mà ông cho là đang xuống cấp trong ngành AI.
Theo TechCrunch ngày 4/10/2026 (giờ địa phương), trong thời gian làm việc tại OpenAI, Robinson phụ trách báo cáo an toàn cho 12 đợt ra mắt mô hình frontier, đồng thời tham gia dẫn dắt việc xây dựng bản dự thảo của “Preparedness Framework” đang được công ty áp dụng. Ông cho rằng để giải quyết rủi ro AI, điều cần thay đổi không chỉ là quy định hay luật lệ riêng lẻ, mà còn là văn hóa vận hành trong doanh nghiệp.
Trọng tâm chỉ trích của Robinson là chiến lược “iterative deployment” của OpenAI. Theo cách tiếp cận này, sản phẩm được tung ra trước, còn các biện pháp bảo vệ sẽ được bổ sung sau khi phát sinh vấn đề. Robinson cho rằng khi năng lực hệ thống ngày càng mạnh hơn, hậu quả từ chỉ một sai sót cũng có thể lớn hơn nhiều. Vì vậy, theo ông, thời kỳ “thử rồi sửa” đã qua.
Ông cũng dẫn lại những sự việc mà OpenAI từng công bố trước đó. Trong một đợt đánh giá an ninh mạng nội bộ hồi tháng 7, các AI agents đã vượt ngoài cơ chế kiểm soát và xâm nhập một phần hệ thống của Hugging Face. Sau đó, công ty tiếp tục ghi nhận các hành vi cho thấy mô hình tìm cách lách giới hạn truy cập Internet. Theo Robinson, việc phát triển những hệ thống vượt trội hơn con người nhưng có thể không vận hành theo đúng ý định của con người là đặc biệt nguy hiểm trong môi trường như vậy.
Robinson cho rằng ngay cả những công ty AI hàng đầu cũng cần áp dụng cơ chế phòng vệ nhiều lớp cùng quy trình vận hành nghiêm ngặt, tương tự các lĩnh vực rủi ro cao như hàng không, điện hạt nhân hay tài chính. Tuy nhiên, ông nói rằng trong thời gian làm việc tại OpenAI, ông không gặp nhiều đồng nghiệp có kinh nghiệm vận hành an toàn trong các ngành như vậy.
Về phía OpenAI, người phát ngôn Drew Pusateri cho biết công ty kiểm soát quá trình phát triển mô hình để bảo đảm năng lực hệ thống không vượt quá ngưỡng có thể quản lý an toàn. Theo ông, OpenAI sẵn sàng dừng huấn luyện hoặc hoãn phát hành nếu cần thiết. Công ty cũng đang tăng cường bảo mật đối với môi trường nghiên cứu và thử nghiệm, mở rộng hoạt động đánh giá từ bên ngoài, đồng thời cải thiện năng lực giám sát theo thời gian thực.
Dù vậy, Robinson cho rằng bên trong OpenAI, áp lực tiến độ ra mắt sản phẩm khiến công ty khó dành đủ thời gian cho những thay đổi mang tính nền tảng. Ông nhấn mạnh ngành AI cần thêm sức ép từ bên ngoài để buộc các doanh nghiệp coi trọng an toàn hơn, đồng thời đẩy mạnh nghiên cứu về “alignment” nhằm giúp AI hành động phù hợp với giá trị và ý định của con người.