AWS 机器学习博客介绍了康泰纳仕与 AWS 生成式 AI 创新中心合作构建的多模态视频检索方案。该方案基于 Amazon Bedrock 与 Amazon OpenSearch Service,采用 TwelveLabs Marengo 嵌入模型,对视频画面、音频与转写文本联合编码,支持自然语言意图检索、以图搜视频与
AWS 详解康泰纳仕多模态视频检索:14 万视频库检索从 250 分钟降至 2 分钟