人工知能(AI)の普及を背景に、Webサイトに流入するボットが急増している。これに伴い、人間かボットかを見分けるためのCAPTCHAやボット検知技術も進化を続けている。従来型の画像パズルやチェックボックスは減りつつあるものの、ボットによるスパム投稿やサイト攻撃、コンテンツの無断収集を防ぐ手段として、CAPTCHAはなお重要な役割を担っている。
The Wall Street Journal(WSJ)は最近、AIの進展によってボットと検知技術の双方が高度化し、Webサイト運営側と攻撃側のせめぎ合いが新たな局面に入っていると報じた。
実際、Webサイトにとって実ユーザーとボットを見分ける必要性は一段と高まっている。インターネットインフラ企業Cloudflareによると、6月時点でボット由来のトラフィックは全体の57%を占め、人間によるアクセスを上回った。ボットを適切に制御できなければ、サイトへの過負荷などでサービス運営に支障を来す可能性がある。CAPTCHAが引き続き必要とされる背景には、こうした事情がある。
CAPTCHAはもともと、歪んだ文字を表示し、サイト利用前に入力を求める方式が主流だった。名称は「Completely Automated Public Turing test to tell Computers and Humans Apart」の略だ。その後、ボットの文字認識能力が向上すると、自転車や信号機が写ったマスを選ばせる画像パズルなど、より複雑な形式へと発展した。
ただ、AIの進歩によって、こうした画像型CAPTCHAの有効性にも疑問が生じている。上海交通大学の研究者ユン・リンは、追加学習なしでも約70%の確率でCAPTCHAを解けるAIエージェントを開発した。WSJによると、リン氏は今後の技術開発によって成功率を90%超まで引き上げられるとみている。
これを受け、Webサイト側でもAIを活用したボット検知の導入が進んでいる。利用者の行動を分析し、カーソル移動の速度や自然さ、スクロールや入力の特徴、IPアドレスの不審な活動履歴、利用デバイスといった情報をスコア化して、人間かボットかを判定する手法だ。従来のCAPTCHAのように利用者が明示的な操作を求められない点が特徴で、より目立たない認証の形として広がりつつある。
一方で、ボット側もこうしたAIベースの検知を回避するため、手法を高度化している。昨年には、OpenAIのAIエージェント「Operator」が、Googleのボット検知システム「reCAPTCHA v3」を突破した事例もあった。
WSJによると、ボットはマウスの移動経路に人間らしい曲線や不規則性を加えるツールを使い、実際の操作で見られるわずかな不完全さまで再現しているという。
Cloudflareでプロダクト担当ディレクターを務めるブライアン・ベッカー氏はWSJに対し、「現時点では検知システムを欺ける水準には達していないが、徐々に近づいている」と語った。
WSJによれば、GoogleやCloudflareといった主要なボット検知技術の提供企業も、既存の検知手法が長期的な“決定打”であり続けるのは難しいとみている。ベッカー氏は「攻撃者は新たな手法を次々に開発し、検知技術を継続的に回避している」とした上で、「ボット検知技術の寿命は短い。およそ12カ月で、この分野では避けられない」と指摘した。
このため業界では、単に相手がボットか人間かを判定するだけでなく、訪問の意図そのものを見極める方向へと軸足を移しつつある。Google Cloudのセキュリティ部門シニアディレクター、アビシェク・ヘムラザニ氏は、「今後は訪問者がボットか人間かを区別するよりも、その意図が善良か悪質かを判断することに焦点が移る可能性がある」と述べた。
ベッカー氏も、「許容できるボットは通しつつ、ほかの利用者の利用を妨げない形をどう実現するかが最大の課題になる」と話している。
もっとも、AIによる検知技術が普及したからといって、自転車や信号機を選ばせる画像グリッド型の認証がすぐに消えるわけではない。Cloudflareによると、利用者がCAPTCHAを直接目にする頻度は前年からわずかに減った程度にとどまっている。WSJは、ボット検知アルゴリズムが不審なアクセスと判断した場合、Webサイト側がチェックボックスのクリックや画像選択といった視覚的認証を引き続き求める可能性があると伝えている。