Dokpamo. Ảnh: ChatGPT

Bộ Khoa học và CNTT Hàn Quốc ngày 20/8 công bố điểm số chi tiết của đợt đánh giá giai đoạn 2 dự án phát triển mô hình nền tảng AI nội địa, còn gọi là Dokpamo. Kết quả cho thấy Motif Technologies, SK Telecom và LG AI Research lần lượt dẫn đầu ở từng nhóm đánh giá.

Theo bộ này, ở nhóm benchmark toàn cầu, Motif Technologies đạt điểm cao nhất. SK Telecom dẫn đầu ở benchmark của Cơ quan Thông tin hóa Quốc gia Hàn Quốc (NIA) và nhóm đánh giá của người dùng chuyên sâu về AI. Trong khi đó, LG AI Research xếp đầu ở phần đánh giá chuyên gia và đánh giá của người dân.

Trước đó, ngày 18/8, Bộ Khoa học và CNTT Hàn Quốc đã công bố kết quả giai đoạn 2 nhưng không nêu doanh nghiệp dẫn đầu cũng như điểm số theo từng hạng mục. Cơ quan này cho biết cách làm này nhằm tránh việc công bố đơn vị đứng đầu có thể làm gia tăng quá mức nhận diện của một doanh nghiệp, đồng thời khiến các đơn vị còn lại chịu tác động bất lợi về mặt hình ảnh, tương tự tranh cãi từng xuất hiện sau đợt đánh giá giai đoạn 1.

Tuy nhiên, sau khi xuất hiện các ý kiến lo ngại về tính minh bạch, bộ đã quyết định công khai thêm dữ liệu chi tiết. Cơ cấu chấm điểm ở giai đoạn 2 gồm benchmark 40 điểm, đánh giá chuyên gia 35 điểm và đánh giá người dùng 25 điểm.

Trong nhóm benchmark, chỉ số Artificial Analysis Intelligence Index (AAII) - hạng mục đánh giá toàn cầu - ghi nhận Motif Technologies đạt 11,9/25 điểm, mức cao nhất. Điểm trung bình của 4 đội tham gia là 9,48 điểm.

AAII sử dụng nhiều bộ benchmark toàn cầu, gồm GDPval-AA v2 và tau3-Banking cho mảng tác tử AI, Terminal-Bench v2.1 và SciCode cho mảng lập trình, cùng các bài kiểm tra về suy luận tổng quát và suy luận khoa học. Trong đó, mảng tác tử AI chiếm 34% tổng điểm AAII, cao nhất trong các hạng mục.

Ở benchmark của NIA, SK Telecom đạt 13,4/15 điểm, đứng đầu. Bài đánh giá gồm 7 lĩnh vực: toán học, kiến thức, hiểu văn bản dài, an toàn, độ tin cậy, tiếng Hàn và khả năng làm theo chỉ dẫn. Điểm trung bình của 4 đội là 13,05 điểm.

Với hạng mục đánh giá chuyên gia, có tổng điểm 35, LG AI Research đạt 29,5 điểm, cao nhất. Điểm trung bình của 4 đội là 28,75 điểm.

Phần đánh giá này do hội đồng chuyên gia bên ngoài thực hiện, gồm 3 người từ khối công nghiệp, 5 người thuộc giới học thuật và 2 người từ các viện nghiên cứu. Các tiêu chí chấm điểm bao gồm chiến lược và năng lực công nghệ phát triển mô hình, kết quả và kế hoạch phát triển, hệ sinh thái cùng tác động lan tỏa toàn cầu. Hội đồng cũng xem xét mức độ dễ sử dụng, tính thực tiễn và khả năng ứng dụng của mô hình trong nhiều lĩnh vực và bối cảnh khác nhau.

Đánh giá người dùng được chia thành hai phần: nhóm người dùng chuyên sâu về AI với thang điểm 15 và nhóm người dân với thang điểm 10. Ở nhóm người dùng chuyên sâu về AI, 49 người tham gia là lãnh đạo các startup AI; SK Telecom đạt điểm cao nhất với 11,6 điểm. Điểm trung bình của 4 đội là 10,53 điểm.

Đối với nhóm người dân, ban tổ chức áp dụng hạn ngạch theo giới tính và độ tuổi. Trong số 200 người được chọn ngẫu nhiên, có 185 người tham gia đánh giá. LG AI Research đạt 7,6/10 điểm, cao nhất, trong khi điểm trung bình của 4 đội là 7,03 điểm.

Từ khóa

#Dokpamo #mô hình nền tảng AI #Bộ Khoa học và CNTT Hàn Quốc #Motif Technologies #SK Telecom #LG AI Research #AAII #NIA
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.