多模态视频理解AI公司Twelve Labs于11日宣布,视频嵌入与检索模型Marengo已接入Amazon Bedrock托管知识库(Managed Knowledge Bases for Amazon Bedrock)。
据介绍,该功能由AWS完成企业数据的接入、索引和检索流程。Twelve Labs表示,Marengo是首个接入这一托管知识库的视频模型,客户无需单独搭建检索系统,即可直接通过自然语言搜索自有视频内容。
例如,用户输入“给我看下半场点球镜头”,系统即可从数千小时的视频中定位并返回对应片段。
Twelve Labs称,过去要实现这类视频检索,通常需要先完成抽帧、语音转文本、生成嵌入,再将结果接入独立数据库。采用托管服务后,客户只需接入视频存储,即可开始搜索。
Twelve Labs战略合作负责人Danny Nicolopoulos表示,与AWS的合作降低了视频检索应用的主要门槛。只要视频存放在Amazon S3,用户无需编写代码,也不必搭建向量检索基础设施,即可直接使用Marengo的多模态搜索能力。“基于语义的视频检索实现了显著跃升。”
记者信息