ElevenLabs 标志

音频 AI 初创公司 ElevenLabs 于 8 月 10 日宣布,正式通过 ElevenAPI 对外提供新一代 AI 配音模型 Dubbing v2。该模型主打在配音过程中尽可能保留原声中的情绪和表演细节。

Dubbing v2 此前已于 5 月 28 日先行推出界面版。随着此次 API 上线,开发者和企业可将其直接接入自有产品及业务流程,用于相关应用和内容生产场景。

ElevenLabs 表示,Dubbing v2 基于音频到音频(audio-to-audio)架构。不同于传统“识别—翻译—语音合成(克隆音色)”流程,该模型可基于输入语音直接生成输出语音,因此更有助于还原原声中的情绪表达和表演细节。

ElevenLabs 计划围绕 Dubbing v2 进一步扩大应用范围,重点面向内容创作者、媒体公司和企业客户,服务希望向全球受众提供高质量内容的用户群体。

目前,Dubbing v2 支持 92 种语言,其中包括韩语和日语。ElevenLabs 预计,这将有助于提升内容进入全球市场时的多语言配音质量,也可用于将海外内容配成韩语等双向应用场景。

关键词

#ElevenLabs #Dubbing v2 #ElevenAPI #AI配音 #音频到音频 #多语言配音 #内容创作者 #媒体公司 #企业集成
版权所有 © DigitalToday。未经授权禁止转载或传播。