Moonshot AIが開発したAI「Kimi K3」(写真=Kimi)

OpenAIは、自社AIモデルの非公開の推論情報を大規模に引き出そうとする組織的な試行を検知し、遮断した。主要な活動グループについては、中国のAIスタートアップMoonshot AIの関係者とつながる可能性があるとしている。

CNBCなどによると、OpenAIが公表した今回の活動は7月1日に小規模に始まった。その後、7月24日から25日にかけて、4,000超の利用者から同様の抽出パターンを示すリクエスト約1万6000件が集中した。

追加調査では、1万5000超の利用者グループでも関連する活動を確認した。OpenAIは7月28日までにこれらを遮断した。なお、1万6000件という数字は推論情報の抽出に成功した回数ではなく、あくまで試行件数だとしている。

OpenAIは一連の手口を「敵対的蒸留(adversarial distillation)」と位置づけた。他社AIの出力や推論情報を無断で大量に取得し、別のモデルの学習や性能改善に利用する行為を指す。

モデル蒸留そのものは一般的な技術だが、競合先の保護された機能を無断で複製する場合は問題になると説明した。

今回の事案は、サーバーやデータベースを突破する従来型のハッキングとは異なる。OpenAIによれば、関係者が同社の暗号化を解読したり、保存されたユーザーの会話に直接アクセスしたりした事実は確認されていない。

その代わり、モデルとのやり取りの仕組みを悪用し、非公開の推論情報を利用者から見える形で再現・取得しようとしたという。OpenAIは関連する経路を遮断したほか、不審なアカウントを制限し、登録時の審査や監視体制も強化した。

もっとも、主体の特定にはなお不明な点が残る。OpenAIは、すべての関係者が単一組織に属しているかどうかは確認できていないとしつつ、主要な活動グループについては、AIサービス「Kimi」を開発したMoonshot AIの関係者に結び付く可能性が高いとの見方を示した。

調査内容は、Frontier Model Forumや政府の情報共有チャネルを通じて、他のAI企業にも共有したという。

Anthropicもこれに先立ち、Moonshot AIを含む中国のAI企業が「Claude」の推論能力を自社モデルの改善に活用しようとしたと主張していた。Anthropicは、Moonshot AIに関連して今年5月から7月にかけて2300万件超のやり取りを観測したとしている。

Moonshot AIは、OpenAIの今回の発表に関する照会に対し、現時点でコメントしていない。

AIモデルの推論能力が競争力の中核資産として重要性を増す中、その複製を狙う試みと防御技術を巡るAI各社のセキュリティ競争は一段と激化する可能性がある。

キーワード

#OpenAI #Moonshot AI #Kimi #人工知能 #推論情報 #敵対的蒸留 #セキュリティ
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.