搜索关键词 音频生成
AI & Enterprise
NC AI发布生成式音频平台VARCO Sound,推出“Sound Agent”智能体
NC AI正式推出生成式AI音频平台VARCO Sound,面向游戏、影视、动画等内容制作场景。正式版新增可通过自然语言调取工具的“Sound Agent”智能体,并强化声音变换、基于视频的多轨生成等能力,同时加入自动混音功能,单次音频生成时长由20秒提升至60秒。
AI & Enterprise
3秒音频就能克隆家人声音,美国AI语音诈骗盯上老年人
美国AI语音诈骗正快速蔓延。诈骗分子只需约3秒音频,便可克隆家人声音,以“紧急求助”等话术诱导受害者转账,老年人尤其容易成为目标。FBI互联网犯罪投诉中心(IC3)数据显示,2025年美国涉AI诈骗投诉超过2.2万起,损失总额达8.93亿美元,其中60岁以上人群损失为3.52亿美元。随着公开音频更易获取、语音克隆工具价格走低,相关讨论也开始更多聚焦于事前身份核验等防控措施。
AI & Enterprise
Stability AI发布Stable Audio 3.0:Medium/Large最长可生成6分20秒完整歌曲
Stability AI推出新一代音频生成模型系列Stable Audio 3.0,其中Medium和Large最长可生成6分20秒完整歌曲,并尽量保持音乐结构和旋律连贯性。该系列分为Small SFX、Small、Medium和Large四档,其中Small SFX、Small和Medium已开放模型权重,Large则仅通过付费API和自托管方式提供。
-
AI & Enterprise
Google发布多模态AI模型Gemini Omni:可基于文本、图片和音频生成视频
-
AI & Enterprise
谷歌音乐生成AI Lyria 3体验:编曲表现不错,但机器感仍明显
-
AI & Enterprise
Reka AI通过全股票交易收购Moonvalley,业务延伸至World Model和机器人
-
Telecommunications & Media
AI重塑媒体业:从内容制作到分发全链条加速落地
-
AI & Enterprise
Microsoft重组Copilot团队:Mustafa Suleyman转向下一代AI模型研发
-
AI & Enterprise
Runway获3.15亿美元E轮融资,加码World Model研发