LG Uplusは10月2日、AIモデル最適化を手掛けるOpt AIと、AIサービス向けのトークン最適化技術について共同研究・開発を進めると発表した。同一のGPUリソースで処理できるトークン量を増やし、AIサービスの処理効率を高める狙いだ。
両社は、AIモデルの演算効率を高めることで、同じインフラ資源でより多くのリクエストを処理できる技術の実用化を目指す。LG Uplusは実サービス環境での検証と適用を担い、Opt AIはAIモデルの軽量化と高速化に向けた技術開発を担当する。
トークンは、AIがユーザーの質問を理解し、回答を生成する際に扱うデータの基本単位。トークン最適化は、モデルの軽量化や演算プロセスの改善を通じて、同一GPUで処理できるトークン量を増やす技術を指す。
両社はすでにGPUベースのAIモデル最適化で初期成果を得ている。AIモデルの回答生成に関わる演算プロセスを実サービス環境に合わせて見直した結果、同一GPUで処理可能なトークン量を従来比で最大4倍まで高めたという。
これに先立ち、両社はオンデバイスAI分野でも協力してきた。LG Uplusは「EXAONE」ベースの小型言語モデル(sLM)に軽量化技術を適用し、スマートフォン向けAI半導体であるNPU上で動作できるようにした。CPUベースと同等の性能を維持しながら、消費電力を78%、モデルサイズを82%削減したとしている。
今回の共同研究・開発を通じて、両社は既存のオンデバイスAIからサーバーGPU環境へと協力範囲を広げる。同一のGPUリソースでより多くのリクエストを処理できるよう、モデルの演算効率を高める技術開発に注力する方針だ。LG Uplusは、今回確保した技術を自社のAIサービスと大規模AIインフラの運用環境に段階的に適用する。
イ・サンヨプLG Uplus CTOは「Opt AIをはじめとする多様なパートナーとの協力を通じて、トークン最適化の研究を広げ、実サービスに生かせる成果につなげていきたい」とコメントした。
イ・ジェホOpt AI代表は「LG Uplusとともに、実サービス環境で検証可能なAI最適化技術の高度化を進める」と述べた。