Amazon Bedrock マネージドナレッジベースが TwelveLabs Marengo 3.0 による動画、音声、画像コンテンツのマルチモーダル埋め込みのサポートを開始

投稿日: 2026年9月11日

AWS は、Amazon Bedrock マネージドナレッジベースの埋め込みモデルとして TwelveLabs Marengo 3.0 が利用可能になったことを発表しました。これにより、お客様は動画、音声、画像コンテンツのマルチモーダル埋め込みを作成できます。Amazon Bedrock マネージドナレッジベースでは、音声と動画をテキストに文字起こしし、テキストベースの埋め込みを生成することで、メディア検索が既にサポートされています。Marengo 3.0 ではさらに、視覚的なシーン、音声、動画の手がかりをマルチモーダル埋め込みに直接エンコードすることで、文字起こしだけではとらえられない意味もとらえることができます。Amazon S3 などのデータソースからメディアアセットをアップロードして同期し、自然言語を使用して検索するだけで利用できます。管理するインフラストラクチャはありません。
Marengo 3.0 はコンパクトな 512 次元ベクトルを生成し、最先端の検索精度を実現します。結果にはセグメントの開始時刻と終了時刻が含まれるため、アプリケーションから動画内の関連する場面に直接移動できます。これにより、スポーツ分析、メディアとエンターテインメント、セキュリティ、教育、小売りなど、幅広いユースケースが可能になります。例えば、複数シーズンにわたる試合映像から特定のプレーを検索したり、キーワードではなく概念に基づいて講義のセグメントを特定したりできます。また、コンテンツの構造に合わせてセグメンテーションオプションを設定できます。
詳細については、Amazon Bedrock ナレッジベースユーザーガイドの TwelveLabs Marengo 3.0 埋め込みモデル統合に関する内容を参照してください。Amazon Bedrock ナレッジベースの製品ページもご覧ください。