Google bắt đầu triển khai Gemini Spark, một AI agent được tích hợp vào trình duyệt Chrome, cho phép tự thực hiện các tác vụ trên web như mua sắm, đặt dịch vụ và điền biểu mẫu. Động thái này cho thấy Google đang mở rộng vai trò của Chrome từ một công cụ duyệt web sang nền tảng hỗ trợ xử lý các công việc lặp lại.
Theo TechRadar ngày 5/8 (giờ địa phương), Google đã công bố Gemini Spark với khả năng kết nối trực tiếp với Chrome. Công cụ này có thể tự truy cập nhiều website khác nhau, chạy nền để so sánh giá, lên lịch và điền biểu mẫu theo yêu cầu của người dùng.
Khác với Gemini trước đây chủ yếu dùng để tìm thông tin và trả lời câu hỏi, Gemini Spark có thể trực tiếp thao tác trên trình duyệt. Người dùng chỉ cần nhập lệnh trong bảng “Ask Gemini” ở phía trên cùng của Chrome.
Sau khi nhận yêu cầu, Spark sẽ đề xuất kế hoạch thực hiện tác vụ và xin quyền truy cập trình duyệt. Khi người dùng chấp thuận, AI sẽ tự di chuyển qua nhiều trang web để hoàn thành công việc.
Hệ thống cũng được thiết kế để tiếp tục chạy nền sau khi tác vụ đã bắt đầu, kể cả khi người dùng đóng cửa sổ Chrome.
Điều kiện sử dụng tính năng này tương đối chặt chẽ. Người dùng phải sử dụng Windows 11 hoặc macOS, cài phiên bản Chrome mới nhất và đăng nhập bằng tài khoản Google cá nhân.
Ngoài ra, người dùng cần đăng ký gói Google AI Pro hoặc Google AI Ultra, đồng thời bật Safe Browsing của Chrome ở chế độ bảo vệ tiêu chuẩn hoặc bảo vệ nâng cao. Sau đó, trong phần cài đặt AI của Chrome, người dùng phải kích hoạt tùy chọn “Let Gemini browse for you”.
Trọng tâm của Gemini Spark là tự động hóa các tác vụ web lặp lại. Chẳng hạn, nếu người dùng yêu cầu “so sánh TV 65 inch trên Amazon, Best Buy, Costco, Walmart và tìm mức giá thấp nhất sau khi áp mã giảm giá”, Spark sẽ lần lượt truy cập từng trang bán lẻ để đối chiếu giá và ưu đãi.
Sau đó, AI có thể đưa sản phẩm vào giỏ hàng và chuẩn bị đến bước trước khi thanh toán.
Tuy nhiên, hệ thống không tự thanh toán. Với các bước liên quan đến giao dịch tiền, Spark sẽ dừng lại và yêu cầu người dùng phê duyệt.
Gemini Spark cũng hỗ trợ lên lịch. Nếu người dùng yêu cầu xây dựng lịch trình cho gia đình gồm hai người lớn và hai trẻ em, AI có thể sắp xếp kế hoạch dựa trên giờ hoạt động và tuyến di chuyển, đồng thời xử lý việc đặt nhà hàng và mua vé bảo tàng đến bước chờ xác nhận cuối cùng.
Tính năng điền biểu mẫu cũng được hỗ trợ. Với các tác vụ như đăng ký thẻ thư viện, Spark có thể tự điền đơn bằng địa chỉ và thông tin liên hệ đã lưu, nhưng thao tác gửi biểu mẫu cuối cùng vẫn do người dùng thực hiện. Google cho biết Spark đặc biệt hiệu quả với các công việc giấy tờ dựa trên dữ liệu có sẵn trong tài khoản Google của người dùng.
Theo Google, quy trình phê duyệt này được thiết kế để cân bằng giữa tự động hóa và an toàn. Với những tác vụ quan trọng như mua hàng hoặc nhập dữ liệu cá nhân nhạy cảm, AI không thể tự ý hoàn tất mà phải có xác nhận từ người dùng.
TechRadar đánh giá cách tiếp cận này cho thấy “sự cân bằng giữa tự động hóa hữu ích và các cơ chế an toàn hợp lý”.
Giới quan sát cũng cho rằng Gemini Spark đánh dấu một bước chuyển trong chiến lược AI của Google. Nếu AI tạo sinh trước đây chủ yếu tập trung vào trả lời câu hỏi hoặc hướng dẫn cách làm, Gemini Spark được xem là bước tiến sang mô hình “agentic AI”, tức AI có thể trực tiếp thao tác trên trình duyệt để hoàn thành công việc.
Việc đưa AI agent vào thẳng Chrome cũng được đánh giá là giúp Google làm rõ chiến lược tái định hình các tác vụ thường nhật trên trình duyệt như tìm kiếm, mua sắm, đặt lịch và soạn thảo tài liệu theo hướng lấy AI làm trung tâm. Dù vậy, do yêu cầu về hệ điều hành mới, phiên bản Chrome mới nhất, gói AI trả phí và thiết lập bảo mật, nhóm người dùng ban đầu nhiều khả năng vẫn sẽ khá hạn chế.
Dù vậy, Gemini Spark đang thu hút sự chú ý như một ví dụ cho thấy trình duyệt web không còn chỉ là công cụ truy cập Internet, mà đang dần trở thành một nền tảng AI có khả năng trực tiếp thực thi công việc.