搜索关键词 实时语音交互
AI & Enterprise
OpenAI为ChatGPT语音模型推出GPT-Live:支持实时双向对话和视觉卡片
OpenAI已开始面向所有用户逐步推送ChatGPT新语音模型GPT-Live。新版本主打更接近自然交流的实时双向语音对话,并新增实时翻译、三档档位和视觉卡片展示。免费用户使用GPT-Live-1 Mini,付费用户则接入GPT-Live-1。
AI & Enterprise
OpenAI升级ChatGPT Voice,推出新语音模型GPT-Live
OpenAI宣布,ChatGPT Voice已上线新语音模型GPT-Live。该模型可在用户说话过程中持续处理语音并实时理解上下文,从而降低对话打断感和响应时延。与此同时,ChatGPT Voice的实时通译功能也完成升级,由“发言结束后按顺序翻译”转向随对话进程即时输出译文。未来,OpenAI还计划将这一架构扩展至更多后端模型、输入输出方式及API场景。
AI & Enterprise
语音智能体竞争升温,韩国初创公司加快布局
语音AI正从传统TTS迈向可实时对话、理解情绪并执行任务的“语音智能体”,技术路径也在由多阶段流程加速转向一体化实时语音模型。随着OpenAI、Google、Amazon、Apple等科技巨头持续加码,韩国初创公司也在加快布局:Humelo推出DIVE引擎,Neosapience则完成165亿韩元Pre-IPO融资。