Motif Technologies, doanh nghiệp bị loại ở vòng đánh giá giai đoạn 2 của dự án mô hình nền tảng AI nội địa do Chính phủ Hàn Quốc triển khai, có tổng điểm thấp hơn LG AI Institute 3,2 điểm. Dù dẫn đầu ở hạng mục benchmark trong số 4 đội tham gia, Motif lại xếp cuối bảng tổng điểm do điểm đánh giá từ chuyên gia và người dùng thấp nhất.
Ngày 27/8, Bộ Khoa học và ICT Hàn Quốc công bố chi tiết kết quả đánh giá của 4 đội tham gia giai đoạn 2, gồm SK Telecom, Upstage, LG AI Institute và Motif.
Theo kết quả được công bố, SK Telecom dẫn đầu với 70,6 điểm, tiếp theo là Upstage với 69,9 điểm, LG AI Institute với 69,0 điểm và Motif với 65,8 điểm. Chênh lệch giữa LG AI Institute, đơn vị xếp thứ ba, và Motif là 3,2 điểm.
Thang điểm đánh giá gồm benchmark 40 điểm, đánh giá chuyên gia 35 điểm và đánh giá người dùng 25 điểm, tổng cộng 100 điểm. Trong phần đánh giá người dùng, nhóm người dùng chuyên môn AI chiếm 15 điểm, còn nhóm người dùng phổ thông chiếm 10 điểm.
Ở từng hạng mục, Motif đạt 24,6 điểm benchmark, cao nhất trong 4 đội, vượt Upstage với 22,7 điểm, SK Telecom với 22,2 điểm và LG AI Institute với 20,6 điểm.
Phần benchmark gồm Artificial Analysis Intelligence Index (AAII), chiếm 25 điểm, và bài đánh giá của Cơ quan Xúc tiến Xã hội Thông tin Thông minh Quốc gia Hàn Quốc (NIA), chiếm 15 điểm. Ở AAII, Motif đạt 11,9 điểm, đứng đầu; tiếp theo là Upstage với 9,4 điểm, SK Telecom với 8,8 điểm và LG AI Institute với 7,8 điểm.
Tuy vậy, ở bài đánh giá của NIA, SK Telecom dẫn đầu với 13,4 điểm. Upstage đạt 13,3 điểm, LG AI Institute đạt 12,8 điểm và Motif đạt 12,7 điểm.
Cục diện thay đổi ở phần đánh giá chuyên gia. LG AI Institute đạt 29,5 điểm, cao nhất trong 4 đội; SK Telecom đạt 29,3 điểm, Upstage đạt 29,1 điểm và Motif đạt 27,1 điểm.
Bộ Khoa học và ICT Hàn Quốc cho biết phần đánh giá này do 10 chuyên gia bên ngoài thực hiện, gồm 3 người đến từ doanh nghiệp, 5 người thuộc khối học thuật và 2 người từ các viện nghiên cứu. Các tiêu chí chấm điểm gồm chiến lược và công nghệ phát triển, kết quả và kế hoạch phát triển, hiệu ứng lan tỏa và kế hoạch đóng góp. Điểm của mỗi đội được tính bằng cách loại điểm cao nhất và thấp nhất theo từng giám khảo, sau đó lấy trung bình phần còn lại.
Khoảng cách tiếp tục nới rộng ở phần đánh giá người dùng. SK Telecom đạt 19,1 điểm, LG AI Institute đạt 18,9 điểm, Upstage đạt 18,1 điểm, trong khi Motif đứng cuối với 14,1 điểm. Riêng chênh lệch điểm người dùng giữa LG AI Institute và Motif là 4,8 điểm.
Trong nhóm người dùng chuyên môn AI, có 49 người tham gia, gồm cả CEO các startup AI. SK Telecom đứng đầu với 11,6 điểm, tiếp theo là LG AI Institute với 11,3 điểm, Upstage với 10,8 điểm và Motif với 8,4 điểm.
Ở nhóm người dùng phổ thông với 185 người tham gia, LG AI Institute đạt điểm cao nhất là 7,6 điểm. SK Telecom đạt 7,5 điểm, Upstage đạt 7,3 điểm và Motif đạt 5,7 điểm.
Tính tổng thể, Motif nhiều hơn LG AI Institute 4,0 điểm ở phần benchmark, nhưng lại kém 2,4 điểm ở phần chuyên gia và kém 4,8 điểm ở phần người dùng, khiến tổng điểm thấp hơn 3,2 điểm.
Việc công bố điểm chi tiết diễn ra ngay sau khi Motif chính thức gửi kiến nghị về kết quả đánh giá giai đoạn 2 trong cùng ngày. Trong tuyên bố của mình, công ty cho biết mô hình “Motif 3” đạt điểm cao nhất ở AAII nhưng vẫn bị loại, đồng thời đề nghị công khai chi tiết điểm số và xem xét lại kết quả.
Motif đặc biệt cho rằng khoảng cách điểm ở phần benchmark đã bị thu hẹp trong quá trình quy đổi sang thang điểm cuối cùng. Công ty cũng yêu cầu làm rõ tiêu chí chi tiết của phần đánh giá chuyên gia và phương pháp chấm điểm ở phần người dùng.
Ngoài ra, Motif cho rằng việc người chấm có thể nhận ra đơn vị phát triển có thể khiến mức độ nhận diện thương hiệu hoặc định kiến ảnh hưởng đến kết quả, vì vậy quá trình đánh giá cần được thực hiện theo hình thức ẩn danh.
Tuy nhiên, Motif nhấn mạnh kiến nghị này không nhằm yêu cầu được lựa chọn lại. Công ty cho biết sẽ không tham gia giai đoạn 3 của dự án, bất kể kết quả xử lý kiến nghị ra sao.
Về phía cơ quan quản lý, Bộ Khoa học và ICT Hàn Quốc cho biết dự án không nhằm tạo ra một “cuộc đua thứ hạng”, cũng không đặt mục tiêu xác định bên bị loại. Theo bộ này, mục tiêu của chương trình là thúc đẩy tăng trưởng của các doanh nghiệp AI, đồng thời mở rộng và nâng cao chất lượng hệ sinh thái AI trong nước.
Bộ cũng cho biết phạm vi công bố kết quả được xác định trên cơ sở cân nhắc đồng thời thiệt hại có thể phát sinh đối với doanh nghiệp, cũng như yêu cầu bảo đảm tính công bằng và minh bạch của quy trình và kết quả đánh giá.