Trụ sở SKT tại Euljiro. Ảnh: SK Telecom

SK Telecom (SKT) đã vượt qua đánh giá giai đoạn 2 của dự án phát triển mô hình AI nền tảng do chính phủ Hàn Quốc triển khai. Sau kết quả này, doanh nghiệp cho biết sẽ mở rộng công nghệ sang AI đa phương thức, AI agent và hướng tới mô hình quy mô nghìn tỷ tham số.

Theo SKT, kết quả đánh giá phản ánh không chỉ năng lực ứng dụng trong công nghiệp mà còn cho thấy tiềm năng đóng góp cho hệ sinh thái AI trong nước. Ở giai đoạn tiếp theo, công ty dự kiến tiếp tục mở rộng quy mô mô hình và phạm vi ứng dụng.

Trong đợt đánh giá giai đoạn 2, các nhóm của SKT, Upstage và LG AI Research đều vượt qua vòng xét chọn. Điểm tổng được tính dựa trên ba hạng mục gồm benchmark 40 điểm, đánh giá chuyên gia 35 điểm và đánh giá người dùng 25 điểm.

Hội đồng chuyên gia đánh giá mô hình của SKT thuộc nhóm có hiệu năng cao nhất trong số các mô hình được so sánh, đặc biệt ở năng lực suy luận toán học và xử lý tiếng Hàn. SKT cũng được ghi nhận về tính thực tiễn khi triển khai mô hình vào các dịch vụ thương mại quy mô lớn.

Một số trường hợp ứng dụng thực tế cũng được đưa vào đánh giá, gồm cung cấp A.X K1 cho lĩnh vực quốc phòng, thử nghiệm AI agent chuyên dụng cho sản xuất và trình diễn các ứng dụng trong lĩnh vực pháp lý - thuế.

Từ A.X K1 đến K2: mở rộng quy mô mô hình AI tự phát triển

Việc phát triển mô hình AI nền tảng của SKT được đẩy mạnh từ A.X K1. Đây là mô hình được phát triển từ đầu, với kiến trúc do SKT tự thiết kế và tự tiền huấn luyện trên dữ liệu, thay vì tiếp tục huấn luyện từ một mô hình có sẵn do doanh nghiệp khác phát triển.

A.X K1 có tổng cộng 519 tỷ tham số, nhưng chỉ kích hoạt 33 tỷ tham số khi xử lý token nhờ kiến trúc Mixture of Experts (MoE). Cách tiếp cận này cho phép mở rộng quy mô mô hình mà không cần tính toán toàn bộ tham số ở mỗi lần suy luận, từ đó cải thiện hiệu quả vận hành.

SKT cho biết quá trình phát triển cũng tích lũy thêm kinh nghiệm trong vận hành hạ tầng huấn luyện mô hình siêu lớn. Công ty đã hợp tác với Nvidia từ năm 2021, thời điểm xây dựng siêu máy tính Titan dựa trên GPU A100, đồng thời hoàn thiện hạ tầng dữ liệu và môi trường huấn luyện. Khi huấn luyện A.X K1, SKT sử dụng bộ dữ liệu Nvidia Nemotron, framework huấn luyện phân tán Megatron-LM và công cụ xử lý, tinh lọc dữ liệu Nemo Curator.

Phiên bản A.X K2 dùng cho đánh giá giai đoạn 2 đã nâng tổng số tham số từ 519 tỷ lên 688 tỷ. Mô hình này áp dụng cấu trúc Sparse Gate Attention (SGA) do SKT tự phát triển. Thay vì xử lý mọi thông tin trong ngữ cảnh dài theo cùng một cách, mô hình sẽ chọn lọc và tham chiếu những thông tin có mức độ liên quan cao hơn. Theo SKT, cách tiếp cận này giúp cải thiện độ chính xác và hiệu quả vận hành trong môi trường công nghiệp thực tế.

Hiệu năng của A.X K2 cũng được cải thiện rõ rệt so với K1. SKT cho biết mô hình mới tăng trung bình 32,2 điểm phần trăm trên 14 bộ benchmark trong và ngoài nước. Riêng các bài đánh giá về khả năng hiểu văn bản dài và năng lực liên quan đến agent tăng khoảng 83,9 điểm phần trăm.

Trong kết quả đánh giá giai đoạn 2 do Bộ Khoa học và CNTT Hàn Quốc công bố, năng lực suy luận toán học là một trong những điểm nổi bật. A.X K2 đạt mức điểm tương đương chuẩn huy chương vàng khi làm bài thi Olympic Toán quốc tế năm 2026, đồng thời đồng hạng cao nhất với độ chính xác 97,1% trên bảng xếp hạng Math Arena AIME 2026, sử dụng đề AIME của kỳ thi toán trung học tại Mỹ.

Mở rộng từ LLM sang AI đa phương thức và AI agent

SKT hiện mở rộng từ mô hình ngôn ngữ lớn (LLM) tập trung vào văn bản sang AI đa phương thức. Trên nền tảng K2, công ty đã phát triển các mô hình phái sinh gồm A.X K2 VL Light-Preview, có khả năng xử lý đồng thời hình ảnh và văn bản, cùng mô hình giọng nói A.X K2 ALM.

Theo SKT, mô hình thị giác có thể được dùng để phân tích bản vẽ công nghiệp và tài liệu quy trình, trong khi mô hình giọng nói phù hợp với các ứng dụng như tổng đài chăm sóc khách hàng, họp trực tuyến và phân tích âm thanh trong môi trường làm việc thực tế.

Bên cạnh việc phát triển mô hình, SKT cũng nhấn mạnh mục tiêu mở rộng ứng dụng vào doanh nghiệp và ngành công nghiệp. Công ty cho biết sẽ triển khai A.X K2 cho các AI agent phục vụ sản xuất tại KG Steel và Konec.

Ở lĩnh vực quốc phòng, SKT đang hợp tác với Bộ Quốc phòng để phát triển ba mô hình lượng tử hóa dựa trên A.X K1. Các mô hình này dự kiến được triển khai tại các đơn vị thuộc lục quân, hải quân, không quân và thủy quân lục chiến.

SKT cho biết nhóm tham gia dự án đang vận hành liên minh theo bốn trục gồm mô hình - hạ tầng, nghiên cứu tiền khả thi, dữ liệu và mở rộng dịch vụ. Mục tiêu là kết nối phát triển mô hình, xây dựng dữ liệu, sử dụng chip AI nội địa, kiểm chứng dịch vụ và ứng dụng công nghiệp thành một hệ thống thống nhất.

Trong giai đoạn tiếp theo, SKT dự kiến nâng quy mô mô hình kế nhiệm A.X K2, tạm gọi là K3, lên ngưỡng nghìn tỷ tham số. Sau khi tăng từ 519 tỷ tham số ở giai đoạn 1 lên 688 tỷ tham số ở giai đoạn 2, công ty đặt mục tiêu tiếp tục scale-up để cạnh tranh về hiệu năng với các mô hình hàng đầu thế giới.

Chính phủ Hàn Quốc cũng dự kiến tăng hỗ trợ GPU cho các nhóm bước vào giai đoạn tiếp theo. Bộ Khoa học và CNTT Hàn Quốc có kế hoạch nâng số GPU Nvidia B200 được hỗ trợ từ khoảng 768 chiếc trong nửa đầu năm lên khoảng 1.000 chiếc trong nửa cuối năm.

SKT cho biết sẽ tận dụng các dịch vụ sẵn có như A.dot, A.dot Biz và Tmap, đồng thời mở rộng ứng dụng sang các lĩnh vực như sản xuất, quốc phòng và sinh học. Công ty đặt mục tiêu đưa mô hình AI tự phát triển vào vận hành thực tế trong cả dịch vụ lẫn công nghiệp, thông qua việc kết hợp mở rộng quy mô mô hình với công nghệ thị giác, giọng nói và AI agent.

Đại diện SKT cho biết doanh nghiệp sẽ tiếp tục tập trung nâng cao hiệu năng mà người dùng có thể cảm nhận trực tiếp, đồng thời tăng cường khả năng thực thi của AI agent và tính hữu dụng trong đời sống cũng như trong môi trường công nghiệp thực tế.

Từ khóa

#SK Telecom #AI #mô hình AI nền tảng #LLM #AI đa phương thức #AI agent #Nvidia #GPU
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.