Eleven v4基准测试对比图。图片来源:ElevenLabs

AI音频公司ElevenLabs于2026年10月1日宣布,推出新一代文本转语音(TTS)模型Eleven v4,并同步发布低延迟版本Eleven v4 Turbo。

据介绍,Eleven v4可根据文本语气、语速、角色设定及上下文生成语音。用户既可通过自然语言指令,也可借助文本标签,对发声方式、情绪表达和音效进行控制。

在语言支持方面,该模型已从v3的70种扩展至90多种。ElevenLabs还引入了新的说话人控制机制,以在多次生成过程中保持不同说话人的声音特征一致,并结合前文语境生成多角色对话。

ElevenLabs表示,在AI模型评测机构Artificial Analysis于9月进行的“Provider Voice Arena”评测中,Eleven v4排名第一。

此次一同发布的Eleven v4 Turbo主要面向实时语音AI代理场景,通过进一步压缩延迟来提升交互体验。该模型的首次响应延迟平均为100毫秒,并可与ElevenLabs对话式代理平台ElevenAgents配合使用。

目前,这两款模型均可在ElevenCreative、ElevenAgents和ElevenAPI中调用。

ElevenLabs联合创始人兼CEO Mati Staniszewski表示,新模型在情绪表达和上下文感知方面能力进一步增强,可用于内容创作、AI代理等场景。

关键词

#ElevenLabs #Eleven v4 #Eleven v4 Turbo #TTS #文本转语音 #低延迟 #ElevenAgents #ElevenAPI #ElevenCreative
版权所有 © DigitalToday。未经授权禁止转载或传播。