写真=Sierra

AIエージェント企業のSierraは10月8日(現地時間)、着信相手が人間かAI音声エージェントかを識別するモデル「fleming-1」を発表した。通話中の音声をリアルタイムで解析し、AI生成音声である可能性をスコアとして表示する。

同社は、個人向けAIエージェントの普及に伴い、今後は企業が受ける電話の相当数を、消費者の代理として動くAIが占める可能性があるとみている。

Sierraは7日、複数のテック企業と共同で「パーソナルエージェントプロトコル」も公表した。エージェントがこのプロトコルに対応していれば、企業側は相手がエージェントであることに加え、誰の代理かも確認できる。

一方で、こうしたプロトコルに従わないエージェントの存在も想定される。fleming-1は、そのようなケースへの対応策として投入する。

同社によると、通話音声から人間の声とAIの声を聞き分けることは、以前より難しくなっている。AI音声の品質が向上しているうえ、雑音や回線の不安定さが判別を難しくするためだ。

fleming-1は、通話中の相手の声をリアルタイムで分析し、AIが生成した音声かどうかをスコア化する。人の耳では捉えにくい特徴量も含めて解析し、通話が終わる前に合成音声かどうかを判定するという。

AI生成音声の可能性が高いと判断した通話には表示を付ける。Sierraは、実在の人物をAIと誤って分類する事態を避けるため、初期設定は保守的にしていると説明している。

同社は、fleming-1は最終判断を下すものではなく、あくまで判断材料を提供する仕組みだと強調した。通話への対応方針は企業側が決めるとしている。fleming-1は、Sierra上で構築したすべての音声エージェントで利用できる。

キーワード

#Sierra #AI #音声エージェント #fleming-1 #AI生成音声 #パーソナルエージェントプロトコル
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.