参会者演示“AI语音泡泡”功能,可筛选特定范围内的人声。图片来源:Seok Dae-geon

在美国夏威夷毛伊岛举行的骁龙峰会2026上,Qualcomm展示了一项面向智能手机端侧AI的语音处理能力。现场演示显示,在通话过程中,系统可过滤数步之外的喊叫声和掌声,仅将手机前方说话者的声音传给对方。

根据9月22日至24日(当地时间)在演示区的实测,手机前方约1米直径范围内的韩语和英语都可被稳定拾取,并通过展位后方的蓝牙音箱清晰播放;超出这一范围的声音则几乎不会被传输出去。就现场体验来看,这项技术已经具备较高的通话可用性。

演示人员将这项功能称为“AI语音泡泡”。其核心逻辑是,依托手机麦克风阵列和端侧AI,在设备周围划定一个约1米直径的有效拾音区域,只优先保留该范围内的人声。演示采用两部手机通话的方式进行,接收端音频则通过展位后方的蓝牙音箱外放。

测试中,当演示人员一边说话一边后退、离开拾音范围后,音箱中的人声随即中断。随后,即便其在范围外提高音量喊话并拍手制造噪声,音箱端依然几乎没有输出。待其重新回到手机前方,人声又会立即恢复传输。现场还演示了另一种情况:即便范围内夹杂手部摩擦等杂音,系统也会进行过滤,最终只将说话者的人声传递给对方。

在手机前方,演示人员交替说出“你好,很高兴见到你”以及英文测试语句,对端音箱均可清晰播放。演示人员表示,系统“只抓取并传输你的声音”。在三次韩语与英语混合测试中,范围内的人声传输未出现明显断续,对端听到的主要是说话者声音,而非展位环境中的背景噪声。

语音质量将影响通话、转写、翻译及AI交互体验

Qualcomm介绍称,手机可通过多麦克风接收声音时的到达时间差,大致判断说话者与设备之间的距离。系统据此构建约1米直径的有效区域,并主要对区域内的人声作出响应。演示中,即便在区域外刻意提高音量喊话,声音也难以被纳入传输范围;人声与其他噪声的区分则由端侧AI完成。

Qualcomm计划将这种“只听目标人声”的能力与代理式AI结合。公司表示,语音正逐步成为唤起AI助手及各类代理的重要交互方式,因此,更准确地捕捉说话者声音的重要性也在提升。无论是通话、消息转写、对话翻译,还是与AI助手进行语音交互,最终体验都会受到拾音质量影响。

与此同时,Qualcomm也在第二代音频平台Snapdragon Sound Elite中为Qualcomm CVC加入AI语音技术。公司举例称,用户佩戴耳机后,可通过语音发出“查找更低价格”或“调整约会日程”等请求,随后由代理连接相关服务完成处理。

此外,该平台还加入了环境声音识别能力。例如,用户在城市道路上开启降噪模式行走时,如有警报声靠近,自适应ANC可识别相关声音并切换至通透模式,让用户听见外界环境声。

需要注意的是,“AI语音泡泡”目前并非官方名称。对于为何使用“泡泡”这一说法,演示人员解释称,这只是内部为方便说明而采用的表述。未来正式产品上市时,可能会使用其他名称;最终命名也将取决于OEM厂商的具体实现方式,不同厂商在导入该技术时也可能采用各自的品牌名称。

关键词

#Qualcomm #骁龙峰会2026 #端侧AI #语音降噪 #麦克风阵列 #Snapdragon Sound Elite #Qualcomm CVC #自适应ANC #定向拾音
版权所有 © DigitalToday。未经授权禁止转载或传播。