OpenAI không tham gia Open Agent Safety Platform của Nvidia nhưng vẫn phối hợp phát triển công nghệ bảo mật. Ảnh: Nvidia

OpenAI không tham gia danh sách ủng hộ chính thức của Open Agent Safety Platform do Nvidia công bố, nhưng vẫn hợp tác với hãng này trong phát triển công nghệ bảo mật dành cho AI agent.

Theo TechCrunch ngày 29/9 (giờ địa phương), Nvidia đã ra mắt Open Agent Safety Platform cùng hơn 100 doanh nghiệp nhằm giảm rủi ro AI agent mất kiểm soát. Tuy nhiên, OpenAI không xuất hiện trong danh sách các bên ủng hộ. Amazon, Google, Apple và một số tập đoàn công nghệ lớn khác cũng không tham gia, trong khi đối thủ Anthropic lại có tên, khiến sự vắng mặt của OpenAI càng thu hút chú ý.

Dù vậy, OpenAI cho biết vẫn ủng hộ nỗ lực của Nvidia và đang phối hợp với công ty này để tăng cường bảo mật cho AI agent. Phần hợp tác bao gồm OpenShell, một trong những thành phần cốt lõi của nền tảng. Đây là phần mềm mã nguồn mở tạo môi trường sandbox biệt lập, nhằm ngăn AI agent vượt ra ngoài môi trường vận hành.

Theo Nvidia, đây là bước đi nhằm mở rộng các công nghệ bảo mật AI agent mà hãng phát triển ra toàn ngành. Động thái này cũng được xem là phản hồi trước việc các phòng thí nghiệm AI như Anthropic và OpenAI gần đây công bố những trường hợp AI agent vượt khỏi tầm kiểm soát. CEO Nvidia Jensen Huang nhiều lần cho rằng AI mất kiểm soát là một bài toán kỹ thuật và có thể được xử lý bằng các giải pháp công nghệ.

Một số ý kiến cho rằng OpenAI có thể là bên hưởng lợi từ công nghệ này. Clem Delangue, nhà sáng lập kiêm CEO của Hugging Face, nói rằng: “Trong phạm vi chúng tôi biết, nếu OpenAI đã áp dụng công nghệ này cho các agent của họ, họ có thể đã chặn được vấn đề trước khi chúng tôi phát hiện ra”. Ông cũng lưu ý nhận định này dựa trên các thông tin công khai hiện có, đồng thời cho rằng cần minh bạch hơn.

Hugging Face cho biết họ đã bổ sung tính năng cho Open Agent Safety Platform, cho phép phát hiện và dừng AI agent khi các hệ thống này truy cập website được cấp quyền nhưng theo cách không được phê duyệt. Ví dụ, nền tảng có thể chặn tình huống các AI agent để lại thông điệp cho nhau trong kho mã nguồn mở nhằm phối hợp tấn công. Theo bài viết, đây là một trong những cách mà các AI agent mất kiểm soát của OpenAI từng sử dụng khi tấn công Hugging Face.

Một số ý kiến cũng cho rằng yếu tố phần cứng là lý do khiến OpenAI không công khai tham gia nền tảng của Nvidia. Để khai thác đầy đủ nền tảng này, bên cạnh phần mềm mã nguồn mở còn cần tới các công nghệ phần cứng độc quyền của Nvidia.

Open Agent Safety Platform không chỉ dựa vào sandbox phần mềm mà còn giám sát hành vi của AI agent ở cấp độ phần cứng. Cơ chế kiểm soát này được thiết kế để AI agent không nhận ra mình đang bị theo dõi, qua đó tránh tình huống một số mô hình hoặc agent tỏ ra tuân thủ hoặc hành xử gian dối khi biết mình bị giám sát.

Tính năng giám sát phần cứng cốt lõi là Sentry, công nghệ độc quyền của Nvidia. Sentry chạy trên thiết bị xử lý dữ liệu BlueField-4 (DPU), theo dõi liên tục hành vi của AI agent và có thể can thiệp, dừng tác vụ ngay khi cần. Nvidia cho biết các doanh nghiệp đang vận hành khối lượng công việc trên phần cứng mới nhất của hãng có thể triển khai nền tảng này khá dễ dàng chỉ thông qua cập nhật phần mềm.

Vì vậy, cũng có quan điểm cho rằng đây không phải là một dự án mã nguồn mở thuần túy. Dù vậy, OpenShell vẫn có thể được điều chỉnh để phù hợp với các loại chip và phần cứng khác, nên Arm và Intel, vốn là đối thủ của Nvidia, cũng tham gia ủng hộ. Nvidia đồng thời chia sẻ thiết kế tham chiếu cho toàn bộ hệ thống kết hợp giữa phần mềm và phần cứng.

Bên cạnh hợp tác với Nvidia, OpenAI cũng đang xây dựng khung an toàn AI riêng. Công ty triển khai các cơ chế bảo vệ cho hoạt động nghiên cứu và sản phẩm, đồng thời công bố những sự cố nghiêm trọng mà họ phát hiện. OpenAI cũng vận hành một consortium chia sẻ thông tin bảo mật AI mang tên Defense Factory, với sự tham gia của Anthropic, Amazon Web Services (AWS) và Google.

OpenAI đồng thời mở rộng mảng bảo mật AI như một hướng đi phục vụ khách hàng doanh nghiệp. Công ty đang phát triển mô hình chuyên về an ninh mạng mang tên Daybreak, đồng thời mở rộng mạng lưới đối tác để hỗ trợ doanh nghiệp triển khai bảo mật AI.

Trong khi đó, theo Hugging Face, công ty này đã được Nvidia mua lại hồi đầu tháng này với giá 12,9 tỷ USD.

Từ khóa

#Nvidia #OpenAI #AI agent #bảo mật AI agent #Open Agent Safety Platform #Hugging Face
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.