搜索关键词 音频模型
AI & Enterprise
Anthropic内部Labs运作模式浮出水面:每两周评估项目去留,创意成功率仅20%至30%
Anthropic内部实验组织Labs约有20名成员,采用人员流动、快速原型开发的运作方式,通常每两周评估项目是否继续推进、调整方向或终止。进展不及预期的项目会被叫停或并入其他方向,验证成功的项目则拆分为独立团队。Anthropic联合创始人Ben Mann表示,Labs创意最终成功率仅为20%至30%,但Claude Code等案例已成长为公司核心产品。
AI & Enterprise
Google发布Gemini 3.5语音模型:可在打断后继续对话,Transcribe覆盖85种语言
Google更新语音模型产品线,推出Gemini 3.5 Live、Gemini 3.5 Live Experimental和语音转写模型Gemini 3.5 Transcribe。新模型提升了对话中断处理能力,并带来多语混合识别、实时视觉理解和工具调用等能力;其中,Gemini 3.5 Transcribe覆盖85种语言,语音到文本输出耗时较Chirp 3缩短约70%,实时语音识别错误率降至5.5%。
AI & Enterprise
Runway发布“Media Router”,可自动调度生成式媒体模型
Runway推出生成式媒体模型路由功能“Media Router”,开发者可按质量、速度和成本设定优先级,由系统自动选择合适模型。该功能通过开发者平台Runway Dev提供,支持以API接入Runway自研及第三方图像、视频、音频模型,旨在降低生成式媒体模型快速增加背景下的选型成本。