Naver ngày 28/8 cho biết các nghiên cứu về trí tuệ không gian, từ tái dựng không gian 3D, hệ thống tự hành đến world model, tiếp tục ghi dấu ấn tại một trong những hội nghị thị giác máy tính lớn nhất thế giới. Tổng cộng 23 bài nghiên cứu của Team Naver đã được chấp nhận tại ECCV 2026, trong đó có 4 bài vào nhóm Spotlight, hạng mục chỉ dành cho khoảng 1-2% tổng số bài nộp.
Theo Naver, các công trình được chấp nhận thuộc về các đơn vị nghiên cứu của Team Naver gồm Naver Labs, Naver Labs Europe, Naver AI Lab và Naver Cloud.
ECCV là hội nghị quốc tế lớn, tổ chức hai năm một lần, trong lĩnh vực thị giác máy tính, xử lý hình ảnh và video. Năm nay, sự kiện diễn ra tại Thụy Điển từ ngày 8 đến 12/9. Nhóm nghiên cứu của Team Naver sẽ trực tiếp trình bày các công trình được chọn tại hội nghị.
Các nghiên cứu trải rộng trên nhiều nhánh của AI thị giác, từ nhận diện và tái dựng không gian 3D, mô hình AI cho ảnh và video, đến mô phỏng chuyển động của robot. Nhiều công trình tập trung vào việc tái dựng không gian thực ở dạng 3D hoặc nâng cao khả năng nhận biết môi trường xung quanh cho robot và hệ thống tự hành.
Naver Labs Europe sẽ giới thiệu BLASt3R, công trình kế tiếp từ công nghệ tái dựng 3D DUSt3R. Nghiên cứu này áp dụng kỹ thuật định vị và lập bản đồ đồng thời (SLAM), cho phép robot vừa di chuyển vừa xác định vị trí và dựng bản đồ môi trường.
Theo Naver, công nghệ này có thể tái dựng không gian 3D trực tiếp trên thiết bị, đồng thời cải thiện tốc độ xử lý và độ chính xác so với mô hình trước đó. DUSt3R được công bố năm 2023 và có khả năng phục dựng không gian 3D chỉ từ một đến hai ảnh.
Một công trình khác của Naver Labs là InSpace, nghiên cứu về công nghệ tái dựng cấu trúc nội thất và vật thể thành không gian 3D dựa trên một ảnh toàn cảnh 360 độ. Công trình này nằm trong nhóm ECCV Spotlight.
Ở mảng tự hành, một nghiên cứu khác ứng dụng mô hình thị giác - ngôn ngữ (VLM) vào môi trường vận hành thực tế. Công trình cho phép nhận diện cả những vật thể chưa từng xuất hiện trong dữ liệu huấn luyện, sau đó cập nhật theo thời gian thực lên bản đồ góc nhìn từ trên xuống (BEV), qua đó mở rộng phạm vi nhận diện của hệ thống tự hành.
Naver AI Lab cũng sẽ trình bày nghiên cứu “Seoul World Model” phối hợp với KAIST. Mô hình này tạo video phản ánh môi trường đô thị thực trên quy mô lớn, dựa trên dữ liệu không gian như ảnh toàn cảnh thu thập trên khắp Seoul.
Naver cho biết công nghệ này có thể được ứng dụng vào trải nghiệm khám phá ảo dựa trên bản đồ, digital twin, mô phỏng tự hành và robot. “Seoul World Model” cũng là một trong các công trình được chọn vào ECCV Spotlight.
Trong khi đó, Naver Cloud công bố các nghiên cứu nhằm nâng cao khả năng hiểu ngữ nghĩa của ảnh và video. Trong số này có công trình phân biệt chuyển động và hành vi của đối tượng trong video, cùng nghiên cứu kết hợp suy luận ngôn ngữ với hình ảnh để suy ra thông tin không gian. Các công trình này đều được chấp nhận vào chương trình chính thức của hội nghị.
Naver cho biết Team Naver duy trì đều đặn số bài được chấp nhận ở mức hai chữ số tại các hội nghị lớn như ECCV, CVPR và ICCV. Công ty dự kiến tiếp tục đưa các kết quả nghiên cứu này vào công nghệ và dịch vụ AI cũng như các ứng dụng trí tuệ không gian.