Sự bùng nổ của AI đang đẩy số lượng bot tăng mạnh, buộc các website phải liên tục nâng cấp captcha và công nghệ phát hiện bot. Tuy nhiên, khi bot ngày càng giỏi vượt qua các lớp xác thực, trọng tâm của cuộc chiến này cũng dần dịch chuyển: không chỉ xác định đâu là người, đâu là bot, mà còn phải đánh giá ý đồ truy cập là hợp lệ hay độc hại.
Theo WSJ, captcha vẫn chưa biến mất và tiếp tục giữ vai trò quan trọng trong việc ngăn bot phát tán thư rác, tấn công website và thu thập nội dung trái phép.
Nhu cầu phân biệt người dùng thật với bot ngày càng cấp bách khi AI trở nên phổ biến. Cloudflare, công ty hạ tầng Internet cung cấp các công cụ bảo mật web và phát hiện bot, cho biết tính đến tháng 6, lưu lượng từ bot đã vượt lưu lượng của người dùng thật và chiếm 57% tổng lưu lượng truy cập.
Nếu bot không được kiểm soát hiệu quả, website có thể rơi vào tình trạng quá tải và khó duy trì dịch vụ ổn định. Đó cũng là lý do captcha vẫn giữ vai trò nhất định trong hệ sinh thái bảo mật web.
Tuy nhiên, cách đối đầu giữa bot và website đã thay đổi đáng kể. Khi cả captcha lẫn bot đều được tăng cường bởi AI, một cuộc cạnh tranh công nghệ mới đang hình thành.
Ở giai đoạn đầu, captcha hiển thị các ký tự bị làm méo và yêu cầu người dùng nhập lại trước khi truy cập. Khi bot cải thiện năng lực nhận diện văn bản, captcha tiếp tục tiến hóa thành các câu đố hình ảnh phức tạp hơn, chẳng hạn yêu cầu chọn tất cả ô có xe đạp hoặc đèn giao thông.
Nhưng sự phát triển của AI cũng làm suy giảm hiệu quả của mô hình này. Nhà nghiên cứu Yun Lin của Đại học Giao thông Thượng Hải đã phát triển một tác tử AI có thể giải captcha với tỷ lệ thành công khoảng 70% mà không cần huấn luyện chuyên biệt. Theo WSJ, ông nhận định tỷ lệ này có thể vượt 90% nếu tiếp tục cải tiến kỹ thuật.
Trước áp lực đó, các website cũng tăng tốc ứng dụng AI để phát hiện bot theo những cách ít gây phiền hà hơn cho người dùng.
AI có thể phân tích hành vi khi truy cập website, như tốc độ và độ tự nhiên của chuyển động chuột, cách cuộn trang và nhập liệu, lịch sử bất thường của địa chỉ IP hay loại thiết bị được sử dụng, sau đó chấm điểm để xác định người dùng là người thật hay bot.
Dù người dùng không dễ nhận ra như với captcha truyền thống, các cơ chế này về bản chất vẫn thuộc nhóm công cụ xác thực theo nghĩa rộng.
Tất nhiên, bot cũng không đứng yên trước các hệ thống phát hiện ứng dụng AI. Chúng liên tục tiến hóa để vượt qua các công nghệ nhận diện mới. Năm ngoái, tác tử AI Operator của OpenAI từng vượt qua Google reCAPTCHA v3, một trong những hệ thống phát hiện bot được sử dụng rộng rãi.
WSJ cho biết bot hiện còn sử dụng các công cụ giúp tạo quỹ đạo chuột có độ cong và tính ngẫu nhiên giống con người, thậm chí mô phỏng cả những sai lệch nhỏ trong chuyển động. Brian Becker, lãnh đạo phụ trách sản phẩm tại Cloudflare, nói với WSJ rằng các kỹ thuật này chưa đủ để đánh lừa hệ thống phát hiện, nhưng đang tiến rất gần tới ngưỡng đó.
Theo WSJ, ngay cả những nhà cung cấp công nghệ phát hiện bot lớn như Google và Cloudflare cũng thừa nhận các giải pháp hiện nay khó còn là lời giải lâu dài.
Ông Becker cho biết bên tấn công liên tục phát triển cách mới để né tránh công nghệ phát hiện, khiến vòng đời hiệu quả của các kỹ thuật này khá ngắn. Theo ông, hiệu quả của một công nghệ phát hiện bot thường chỉ kéo dài khoảng 12 tháng, và đây là đặc thù khó tránh của lĩnh vực này.
Vì vậy, dù công nghệ phát hiện bot sẽ tiếp tục được nâng cấp, ngành bảo mật đang dần chuyển trọng tâm từ việc phân biệt bot với con người sang phân tích mục đích truy cập.
Abhishek Hemrajani, giám đốc cấp cao mảng an ninh của Google Cloud, cho rằng về lâu dài, trọng tâm có thể chuyển từ nhận diện người hay bot sang đánh giá người truy cập mang ý đồ tốt hay xấu. Ông Becker cũng nhận định thách thức lớn nhất sẽ là làm sao để các “bot tốt” được đi qua mà không ảnh hưởng đến trải nghiệm của những người dùng khác.
Dù công nghệ phát hiện bằng AI ngày càng phổ biến, việc các lưới ảnh xe đạp hay đèn giao thông có biến mất hoàn toàn hay không vẫn còn bỏ ngỏ. Theo Cloudflare, tần suất người dùng trực tiếp nhìn thấy captcha chỉ giảm nhẹ so với cùng kỳ năm trước.
WSJ cho biết khi hệ thống phát hiện bot đánh giá một phiên có dấu hiệu đáng ngờ, website vẫn có thể yêu cầu xác thực trực quan, như bấm vào ô checkbox hoặc chọn một hình ảnh cụ thể trong lưới ảnh.