Logo của Crowdworks. Ảnh: Crowdworks

Crowdworks ngày 3/9 cho biết đã giành gói thầu xây dựng hệ thống kiểm chứng an toàn và độ tin cậy cho AI agent trong dự án do Bộ Khoa học và ICT Hàn Quốc cùng Cơ quan Xã hội Thông tin Thông minh Quốc gia (NIA) triển khai.

Dự án hướng tới việc xây dựng một hệ thống có khả năng đánh giá mức độ an toàn và độ tin cậy của AI agent trong toàn bộ quá trình lên kế hoạch, gọi công cụ bên ngoài và thực hiện nhiệm vụ.

Trong liên danh thực hiện dự án, Crowdworks phụ trách xây dựng các kịch bản suy luận đa bước cùng bộ dữ liệu kiểm chứng phù hợp với đặc thù Hàn Quốc.

Hệ thống này không chỉ đánh giá độ chính xác của câu trả lời cuối cùng mà còn thẩm định tính hợp lý của toàn bộ quá trình AI agent tạo ra câu trả lời và xử lý tác vụ.

Để triển khai, công ty sẽ thiết kế các kịch bản với nhiều cấp độ khó khác nhau, yêu cầu AI agent gọi tuần tự hoặc song song nhiều công cụ dựa trên Model Context Protocol (MCP) và các API bên ngoài.

Crowdworks cũng dự kiến xây dựng hơn 7.000 mẫu dữ liệu kiểm chứng, phản ánh môi trường dịch vụ tại Hàn Quốc và các dạng dữ liệu thường xuyên thay đổi.

Dự án do SureSoftTech chủ trì, với sự tham gia của Crowdworks, Viện Khoa học và Công nghệ Tiên tiến Hàn Quốc (KAIST) và Hiệp hội Công nghiệp Trí tuệ nhân tạo Hàn Quốc.

Liên danh đặt mục tiêu hoàn tất hệ thống kiểm chứng cho AI agent vào cuối năm nay.

Đại diện Crowdworks cho biết khi AI agent ngày càng được ứng dụng rộng rãi, việc kiểm chứng mức độ an toàn và độ tin cậy của quy trình thực thi đang trở nên quan trọng hơn.

Theo đại diện công ty, Crowdworks sẽ tận dụng năng lực xây dựng dữ liệu và đánh giá để góp phần hình thành một hệ thống kiểm chứng phù hợp với môi trường Hàn Quốc.

Từ khóa

#Crowdworks #AI agent #NIA #Bộ Khoa học và ICT Hàn Quốc #MCP #API #KAIST #kiểm chứng AI
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.