据路透社7月31日报道,中国AI公司MiniMax发布新一代视频生成模型H3,正式切入与ByteDance、Kuaishou等公司的竞争。
MiniMax表示,H3支持文本、图像、视频和音频等多模态输入,最高可生成2K分辨率、时长15秒的视频,并支持原生立体声。除视频生成外,该模型还支持视频编辑,可结合不同形式的指令和参考素材,实现视频间动作迁移。
公司还计划在数日内开源H3模型权重,供用户下载并自行修改。当前视频生成领域仍以闭源模型为主,但多家中国AI公司正推动“开源权重”模式在这一方向加快普及。
MiniMax成立于2022年,已在香港交易所上市。
路透社7月初曾援引消息人士称,MiniMax计划于本月发布H3,同时正在开发一款参数规模达2.7万亿的语言模型。
记者信息