搜索关键词 Gemini Omni
AI & Enterprise
Black Forest Labs发布多模态模型FLUX 3:支持20秒音视频同生,拓展机器人控制
Black Forest Labs发布首款可同时生成视频和音频的AI模型FLUX 3,最长支持20秒视频生成,并可同步生成对白、音效和背景音乐。公司还将其定位为“Physical AI”基础模型,进一步延伸至机器人控制,并与Mimic Robotics联合推出FLUX-mimic,已在Audi生产线展开试验,整套系统的响应时延约101毫秒。
AI & Enterprise
Google Vids新增AI数字人头像功能:上传自拍和语音即可生成分身
Google为视频制作工具Google Vids新增AI数字人头像功能,用户上传自拍和语音样本后,即可生成与本人相似的数字化分身并用于视频创作。与此同时,Vids接入多模态模型Gemini Omni,可结合文本提示和参考图片生成视频内容,并支持手机拍摄视频的背景替换、光线校正和特效添加等功能。
AI & Enterprise
ChatGPT、Gemini Omni可低成本生成短广告:10秒视频约1美元
据报道,只需一张产品图片,配合ChatGPT、Gemini Omni等生成式AI工具,即可在无需实拍的情况下制作面向TikTok和YouTube的10秒左右产品广告。按开发者API计费,视频生成成本约为每秒0.10美元,单条视频生成成本约1美元,后期可通过CapCut完成剪辑,但发布时需满足平台对AI生成内容的标注和披露要求。
-
AI & Enterprise
Google发布“Nano Banana 2 Lite”图像生成模型:成本减半,生成速度最高提升2.7倍
-
AI & Enterprise
Google发布“Nano Banana 2 Light”:图像生成提速降本
-
Industry
Leica:生成式AI不会进入M系列相机,或用于Xiaomi 17T系列等合作机型
-
AI & Enterprise
OpenAI冲刺IPO遇考验:营收增长难掩高亏损,ChatGPT增速放缓
-
AI & Enterprise
AI基础设施升温带火本地部署硬件,传统企业设备厂商重获关注
-
AI & Enterprise
YouTube测试对话式AI搜索“Ask YouTube”,Shorts创作工具引入Gemini Omni
-
Crypto
Google 更新 Gemini 应用:推出“每日简报”,加入 AI 视频生成模型 Gemini Omni
-
AI & Enterprise
Google发布多模态AI模型Gemini Omni:可基于文本、图片和音频生成视频