Nvidia vừa mở rộng NVIDIA AI for Media, bộ công cụ AI dành cho lĩnh vực phát sóng, truyền hình thể thao và streaming. Nền tảng này được bổ sung loạt tính năng mới, từ tạo khung hình, nâng độ phân giải, theo dõi chuyển động vận động viên đến đồng bộ khẩu hình theo thời gian thực và cải thiện chất lượng giọng nói trong cùng một quy trình xử lý AI.
Ngày 15/9 theo giờ địa phương, Nvidia cho biết tính năng Video Frame Generation (VFG) có thể tạo các khung hình trung gian bằng AI giữa những khung hình sẵn có, qua đó nâng tốc độ khung hình lên 2 hoặc 4 lần. Với truyền hình thể thao, công cụ này có thể được dùng để tạo các đoạn phát lại và slow-motion mượt hơn. Các mức 6x và 8x hiện vẫn trong giai đoạn thử nghiệm, đánh giá.
Video Super Resolution (VSR) cho phép nâng video độ phân giải thấp lên tối đa 8K, đồng thời giảm nhiễu, độ mờ và artifact do nén. Công cụ này cũng hỗ trợ video 10-bit. Trong khi đó, TrueHDR có thể chuyển đổi video SDR sang HDR theo thời gian thực, giữ nguyên độ tương phản gốc và mở rộng dải sáng lên khoảng 2.000 nit. Theo Nvidia, VFG, VSR và TrueHDR có thể kết hợp trong cùng một pipeline xử lý hình ảnh.
Nvidia cũng tăng cường các tính năng phân tích chuyển động con người. Công cụ 3D Body Pose có thể theo dõi chuyển động các khớp trên toàn cơ thể từ nguồn video quay bằng một camera, không cần marker, sau đó chuyển đổi thành dữ liệu phục vụ hoạt hình 3D. Ứng dụng của công cụ này bao gồm phân tích vận động viên, phát lại tình huống và sản xuất hoạt hình.
Phục vụ nhu cầu bản địa hóa nội dung, Nvidia bổ sung hai tính năng LipSync và Active Speaker Detection. Trong đó, LipSync điều chỉnh chuyển động môi của nhân vật theo phần lồng tiếng đã dịch theo thời gian thực. Active Speaker Detection phân tích đồng thời hình ảnh và âm thanh để xác định người đang nói trong các cảnh có nhiều nhân vật. Nvidia cho biết LipSync hiện hỗ trợ thêm tiếng Pháp, tiếng Đức và tiếng Tây Ban Nha.
Ở mảng âm thanh, Studio Voice giúp nâng chất lượng giọng nói thu từ micro thông thường lên mức phù hợp cho phát sóng, đồng thời công cụ khử tiếng ồn giúp giảm tạp âm từ môi trường xung quanh. Nvidia cũng tiếp tục cải thiện Synthetic Video Detector, công cụ dùng để phát hiện video do AI tạo ra.
Động thái mới cho thấy Nvidia đang đẩy mạnh việc đưa AI vào toàn bộ quy trình sản xuất phát sóng, từ tạo nội dung, biên tập, dịch thuật đến kiểm chứng nội dung.