Chính phủ Hàn Quốc sẽ đẩy nhanh lộ trình công bố bộ “Top 100 dữ liệu công cho AI và dữ liệu công giá trị cao”, rút ngắn một năm so với kế hoạch ban đầu. Đồng thời, 37 bộ dữ liệu và tác phẩm công trước đây chỉ cung cấp cho các nhóm phát triển mô hình nền tảng AI nội địa cũng sẽ được mở cho toàn bộ doanh nghiệp AI.
Ngày 27/8, Thủ tướng Han Seong-sook chủ trì cuộc họp liên bộ trưởng về dữ liệu lần thứ hai tại trụ sở Chính phủ ở Seoul để thảo luận phương án mở rộng phạm vi chia sẻ dữ liệu công.
Theo Chính phủ Hàn Quốc, chương trình “Top 100 dữ liệu công cho AI và dữ liệu công giá trị cao” sẽ được hoàn tất trong năm 2027, sớm hơn kế hoạch một năm. Chương trình này lựa chọn 100 bộ dữ liệu công có nhu cầu cao trong phát triển AI và có tác động lớn về kinh tế - xã hội để công khai cho bên ngoài khai thác.
Sau khi công bố 10 bộ dữ liệu trong năm ngoái, Chính phủ đã mở thêm 25 bộ trong năm nay. Năm tới, 65 bộ còn lại sẽ được công bố. Theo kế hoạch trước đó, 30 bộ sẽ được mở trong năm 2027 và 35 bộ còn lại vào năm 2028.
Từ năm 2015 đến nay, Hàn Quốc đã mở tổng cộng 267 bộ dữ liệu công chất lượng cao, qua đó tạo ra 3.625 dịch vụ của khu vực tư nhân.
Chính phủ cho biết dữ liệu tổng hợp về lịch sử sử dụng thẻ giao thông của Korea Transportation Safety Authority đang được sử dụng để phân tích hiệu quả vận hành giao thông theo nhu cầu. Trong khi đó, các trường hợp giải thích pháp luật và các phán quyết về khiếu kiện hành chính đặc biệt của Bộ Pháp chế được các công ty legaltech dùng làm dữ liệu huấn luyện cho AI pháp lý và làm căn cứ xây dựng câu trả lời.
Ngoài việc đẩy nhanh công bố dữ liệu công giá trị cao, Chính phủ cũng mở rộng hỗ trợ dữ liệu công và tác phẩm công phục vụ nâng cấp mô hình nền tảng AI nội địa.
Trước đó, Chính phủ đã cung cấp cho các nhóm tham gia dự án mô hình nền tảng AI nội địa 50 bộ dữ liệu và tác phẩm công do 33 bộ, ngành và cơ quan quản lý nắm giữ, với quy mô khoảng 23,93 triệu hồ sơ dữ liệu. Trên cơ sở đề nghị bổ sung từ các nhóm này, Bộ Khoa học và CNTT Hàn Quốc cùng Bộ Văn hóa, Thể thao và Du lịch tiếp tục rà soát thêm 102 bộ dữ liệu và tác phẩm công do các bộ, ngành và cơ quan liên quan quản lý.
Kết quả, 37 bộ không phát sinh vướng mắc về bản quyền và dữ liệu cá nhân - gồm tài liệu chính sách, ấn phẩm của cơ quan nhà nước, biên bản nghị quyết và kết luận của các hội đồng, cùng một phần tuyển tập tình huống và đề thi chứng chỉ - sẽ được chuyển sang hình thức gắn nhãn Public Nuri loại AI để mọi doanh nghiệp AI có thể sử dụng.
Public Nuri loại AI là nhãn phân loại được thiết lập từ tháng 1 năm nay, cho phép sử dụng tự do tác phẩm công cho mục đích huấn luyện AI. Qua đợt rà soát này, số bộ dữ liệu được xác nhận có thể cung cấp cho các nhóm phát triển mô hình nền tảng AI nội địa là 64 bộ, trong đó 37 bộ sẽ được mở rộng cho cả doanh nghiệp AI nói chung.
Các bộ, ngành sẽ tiếp tục kiểm tra tình trạng gắn nhãn Public Nuri đối với tác phẩm công thuộc phạm vi quản lý, đồng thời rà soát thêm những tài liệu có thể áp dụng nhãn AI. Bộ Văn hóa, Thể thao và Du lịch cũng đang thúc đẩy sửa đổi Luật Bản quyền nhằm mở rộng phạm vi công khai tác phẩm công.
Phát biểu tại cuộc họp, Thủ tướng Han Seong-sook nhấn mạnh dữ liệu công là “tài sản quốc gia không thể thay thế, được tích lũy trong thời gian dài trên mọi lĩnh vực của kinh tế và xã hội”. Theo bà, năng lực cạnh tranh AI toàn cầu sẽ phụ thuộc vào mức độ dữ liệu công chất lượng cao được mở rộng và khai thác hiệu quả ra sao.
Bà cũng cho rằng dữ liệu công được hình thành từ tiền thuế của người dân, vì vậy việc công khai là nguyên tắc tất yếu. Chính phủ sẽ tiếp tục hỗ trợ để khu vực tư nhân có thể khai thác hiệu quả dữ liệu cho AI và AX.