Trong vòng đánh giá thứ hai của dự án phát triển mô hình AI nền tảng nội địa của Hàn Quốc, khả năng ứng dụng vào thực tế đã trở thành yếu tố phân định kết quả. Motif Technologies bị loại dù đạt điểm benchmark toàn cầu cao nhất, trong khi Upstage, SK Telecom và LG AI Research giành quyền vào vòng 3 nhờ lợi thế về triển khai dịch vụ, thử nghiệm trong ngành và kế hoạch mở rộng hệ sinh thái.
Ngày 18/8, Bộ Khoa học và CNTT Hàn Quốc cho biết Upstage, SK Telecom và LG AI Research đã vượt qua vòng đánh giá giai đoạn 2 của dự án “mô hình AI nền tảng nội địa” để bước vào vòng tiếp theo. Motif Technologies là đội duy nhất bị loại.
Theo cơ cấu chấm điểm ở vòng này, benchmark chiếm 40 điểm, đánh giá chuyên gia 35 điểm và đánh giá người dùng 25 điểm.
Tại họp báo công bố kết quả ở trụ sở Chính phủ tại Seoul, ông Ryu Je-myeong cho biết việc Motif Technologies không đi tiếp chủ yếu phản ánh khoảng cách ở nhóm tiêu chí liên quan đến khả năng sử dụng và ứng dụng thực tế, vốn chiếm tỷ trọng lớn trong 75 điểm của phần đánh giá phi benchmark, dù năng lực công nghệ của doanh nghiệp này được đánh giá rất cao.
Motif Technologies đạt 47 điểm trên chỉ số AAII do nền tảng đánh giá AI toàn cầu Artificial Analysis công bố, cao nhất trong bốn đội vào vòng 2. Theo AAII, đây cũng là mô hình có hiệu năng cao nhất trong nhóm các mô hình do doanh nghiệp ngoài Mỹ và Trung Quốc phát triển, đồng thời nằm trong top 10 toàn cầu theo tiêu chí “mô hình tốt nhất” của từng công ty AI.
Trong khi đó, ba đội được chọn đều nhấn mạnh mạnh hơn vào các kịch bản ứng dụng thực tế bên cạnh năng lực công nghệ.
Upstage đưa ra kế hoạch triển khai mô hình trên cổng thông tin Daum và Timely, đồng thời đề xuất hợp tác với FuriosaAI trong lĩnh vực bộ xử lý mạng nơ-ron (NPU). Doanh nghiệp này cũng đã thực hiện thử nghiệm PoC trong môi trường dịch vụ của Daum, được xem là ví dụ về ứng dụng đồng thời phần mềm và phần cứng AI nội địa.
SK Telecom được đánh giá cao không chỉ ở năng lực suy luận toán học và tiếng Hàn, mà còn ở việc đã đưa mô hình vào vận hành trong các dịch vụ thương mại quy mô lớn. Công ty cũng trình bày năng lực ứng dụng tại hiện trường thông qua mô hình phục vụ quốc phòng, thử nghiệm AI agent chuyên biệt cho sản xuất cùng các bản demo trong lĩnh vực pháp lý và thuế.
LG AI Research giới thiệu chiến lược mở rộng hợp tác với các tổ chức toàn cầu, trong đó có các tổ chức quốc tế, đồng thời nhấn mạnh định hướng khác biệt hóa bằng agentic AI, độ tin cậy của mô hình và hệ thống quản trị rủi ro. Theo Bộ Khoa học và CNTT Hàn Quốc, các yếu tố về an toàn, độ tin cậy và khả năng tạo tác động ở quy mô toàn cầu cũng được đưa vào đánh giá.
Cơ cấu chấm điểm của dự án được thiết kế theo hướng không để thứ hạng bị quyết định chỉ bởi hiệu năng công nghệ. Trong tổng 100 điểm, riêng điểm AAII chỉ chiếm 25 điểm. Phần benchmark gồm 25 điểm từ AAII và 15 điểm từ bài đánh giá của Cơ quan Xúc tiến Xã hội Thông tin Quốc gia Hàn Quốc (NIA). Phần còn lại là 35 điểm đánh giá chuyên gia và 25 điểm đánh giá người dùng.
So với vòng 1, vòng 2 tăng cường rõ hơn phần đánh giá liên quan đến khả năng ứng dụng, nhằm đo cả mức độ dễ sử dụng lẫn cảm nhận về hiệu quả từ người dùng thực tế. Trong đánh giá chuyên gia, điểm cho tiêu chí “tác động đối với hệ sinh thái AI trong và ngoài nước và kế hoạch đóng góp” được nâng từ 10 lên 15 điểm. Ở phần đánh giá người dùng, ngoài nhóm người dùng AI chuyên nghiệp, ban tổ chức bổ sung thêm 10 điểm chấm từ nhóm người dùng đại chúng.
Dù vậy, cơ quan quản lý cho rằng kết quả không thể quy hoàn toàn về một tiêu chí riêng lẻ. Theo Bộ Khoa học và CNTT Hàn Quốc, chênh lệch giữa đội đứng đầu và đội xếp cuối ở phần benchmark là 4 điểm, ở đánh giá chuyên gia là 2,4 điểm và ở đánh giá người dùng là 5 điểm. Đội dẫn đầu ở từng hạng mục cũng không trùng nhau.
Ông Ryu Je-myeong nói khó có thể coi một hạng mục cụ thể là yếu tố quyết định duy nhất, bởi kết quả cuối cùng được hình thành từ tổng hòa chênh lệch ở nhiều tiêu chí.
Đối với phần chấm điểm từ người dùng đại chúng, ban tổ chức nhận khoảng 1.400 đơn đăng ký, chọn 200 người và cuối cùng có 185 người tham gia. Bộ Khoa học và CNTT Hàn Quốc cho biết điểm số từ nhóm này không làm thay đổi kết quả lựa chọn các đội vào vòng tiếp theo.
Những tranh cãi xung quanh hoạt động benchmark trước và sau vòng đánh giá cũng không được phản ánh vào kết quả cuối cùng. Bộ Khoa học và CNTT Hàn Quốc cho biết đã đề nghị Artificial Analysis phân tích thêm và nhận được phản hồi rằng không có dấu hiệu cho thấy các đội tham gia thực hiện hành vi học thuộc có hệ thống hoặc overfitting nhằm tối ưu cho bài đánh giá. Cơ quan này cũng cho biết đánh giá chuyên gia không phát hiện yếu tố nào làm ảnh hưởng đến tính công bằng của cuộc cạnh tranh.
Sau khi kết thúc thời hạn tiếp nhận khiếu nại đối với kết quả vòng 2, dự án sẽ bước vào vòng 3. Motif Technologies cho biết sẽ không nộp đơn khiếu nại. Theo kế hoạch hiện tại, vòng 3 vẫn giữ lộ trình chọn 2 đội cuối cùng từ 3 đội còn lại.
Tuy nhiên, các tiêu chí và trọng số chấm điểm của vòng 3 vẫn chưa được ấn định. Ông Ryu Je-myeong cho biết cơ quan quản lý sẽ rà soát những điểm cần bổ sung sau hai vòng đầu, tham vấn ba doanh nghiệp tham gia rồi công bố phương án cuối cùng sớm nhất có thể.
Trong nửa cuối năm, mỗi đội vào vòng 3 sẽ được hỗ trợ lượng GPU Nvidia B200 tương đương khoảng 1.000 chiếc, cao hơn mức khoảng 768 chiếc trong nửa đầu năm. Ông Choi Dong-won, Vụ trưởng Chính sách hạ tầng AI thuộc Bộ Khoa học và CNTT Hàn Quốc, cho biết nếu tính theo phương án thuê trong 6 tháng, chi phí tương đương khoảng 40 tỷ won cho mỗi đội, tức khoảng 120 tỷ won cho cả ba đội.
Dù vẫn giữ kế hoạch chọn 2 đội cuối cùng, chính phủ Hàn Quốc đang xem xét lại cách thức hỗ trợ trong năm 2027. Theo thiết kế ban đầu, dự án sẽ chọn ra 2 đội sau vòng 3, sau đó tiếp tục hỗ trợ thêm một năm trong 2027 để phát triển mô hình AI đạt khoảng 95% năng lực so với các mô hình hàng đầu thế giới.
Tuy nhiên, trong bối cảnh hiệu năng của các mô hình frontier toàn cầu tăng nhanh, chính phủ và doanh nghiệp tham gia đang đánh giá lại liệu quy mô hỗ trợ hiện nay và hình thức cạnh tranh hiện tại có đủ để đạt mục tiêu ban đầu hay không. Ông Ryu Je-myeong cho biết cơ quan quản lý đã liên tục thảo luận với doanh nghiệp về khả năng theo kịp tốc độ phát triển của nhóm công ty frontier bằng phương thức hỗ trợ hiện nay.
Sau họp báo, ông Kim Gyeong-man, Vụ trưởng Chính sách AI thuộc Bộ Khoa học và CNTT Hàn Quốc, cho biết nếu muốn cạnh tranh ở cấp độ frontier, có thể phải cân nhắc mô hình có quy mô tham số tối thiểu 1 nghìn tỷ (1T). Khi đó, nguồn lực bổ sung có thể cần tới quy mô hàng nghìn tỷ won.
Chính phủ cũng đang xem xét phương án liên kết và tái cấu trúc dự án này với các chương trình liên quan, trong đó có dự án trí tuệ nhân tạo tổng quát (AGI).
Theo ông Ryu Je-myeong, Hàn Quốc cần một “sân chơi cạnh tranh mới”. Cơ quan quản lý hiện thảo luận với doanh nghiệp về việc nên tiếp tục phân bổ nguồn lực theo cách hiện nay hay tập trung hơn, đồng thời cân nhắc mô hình liên minh doanh nghiệp phù hợp. Trong nội bộ chính phủ, khả năng hỗ trợ tài chính và hiệu quả tổng thể của dự án cũng đang được rà soát.
Ông cho biết thêm rằng khi ngân sách chính phủ được chốt, cơ quan quản lý sẽ có thể sớm công bố lại các nội dung đang được thảo luận.