平易な言葉によるマルチモーダル検索
シーンを平易な英語で説明すると、動画、画像、音声、ドキュメント全体から一致する瞬間を取得できます。ホームページでは、これはマルチモーダルコンテンツに対するセマンティック検索として位置付けられています。
Mixpeek は、平易な言葉によるクエリを使って、動画、画像、音声、ドキュメントのライブラリ内にあるシーン、瞬間、その他のコンテンツを見つけられる動画検索・マルチモーダル検索取得プラットフォームです。生ファイル向けの管理型抽出パスと、すでに埋め込みを持っているチーム向けのベクトルストアパスを組み合わせています。
ホームページと料金ページでは、プロダクトはオブジェクトストレージを中心に構成されています。ファイルを接続して Mixpeek にシーン、顔、OCR、トランスクリプト、埋め込みを抽出させることも、自分のベクトルを持ち込んで dense、sparse、または BM25 クエリで検索することもできます。その結果、ファイル名の検索ではなくコンテンツレベルの検索を必要とするメディアライブラリ、アーカイブ、エージェントワークフロー向けの検索レイヤーが得られます。
シーンを平易な英語で説明すると、動画、画像、音声、ドキュメント全体から一致する瞬間を取得できます。ホームページでは、これはマルチモーダルコンテンツに対するセマンティック検索として位置付けられています。
オブジェクトストレージを接続すると、Mixpeek がシーン、顔、OCR、トランスクリプト、埋め込みを自動抽出します。これは、パイプラインを自前で構築せずにファイルをインデックスしたいチーム向けの管理型パスです。
MVS をオブジェクトストレージ上のベクトルストアとして使い、dense、sparse、BM25 検索を行えます。料金ページでも、自分の埋め込みを持ち込んで直接検索できることが示されています。
filter、join、rerank のステップを組み合わせたマルチステージ検索パイプラインを構築できます。サイトでは、これらの retrievers を100ミリ秒未満で構成できると説明しています。
顔、シーン、トランスクリプト、OCR、fingerprints、埋め込み向けの型付き extractor を扱えます。extractor ページでは、これらのパイプラインが文書化され、連結できることが示されています。
Mixpeek を S3、GCS、R2、Mux、LangChain、MCP などの既存のストレージやツールに接続できます。integrations ページは、データ移行ではなく既存スタックへの組み込みを中心に構成されています。
編集者、プロデューサー、社内ツールが、ファイル名や手動タグではなく、シーンで何が起きているかに基づいて動画アーカイブを検索できるようにします。ホームページでは特に、動画ライブラリ内の正確な瞬間を見つける用途として位置付けられています。
メディアライブラリ全体で、人物や顔が登場するクリップを特定します。サイトでは、特に大規模な動画コレクションにまたがる検索を含む、顔・人物検索を主要なユースケースとして強調しています。
PDF、講義録画、会議のトランスクリプトを、特定の発話フレーズ、図表レイアウト、文書領域で検索します。ソースには、トランスクリプト検索、OCR、レイアウト抽出の例があります。
ストレージを接続し、新しいアップロードを自動でインデックスして、コンテンツの変化後もライブラリを検索可能に保ちます。これは、手動タグ付けなしで継続的なインデックス作成を求めるチームに適しています。
クロスモーダル join を使って、同じタイムスタンプでの話者、画面上のテキスト、シーンの文脈など、複数のシグナルを必要とする複合クエリに答えます。
Mixpeek には主に2つの方法があります。1つは Managed indexing で、バケットを接続すると Mixpeek がファイルからシーン、顔、OCR、トランスクリプト、埋め込みを抽出します。もう1つは MVS で、自分の埋め込みを持ち込み、オブジェクトストレージ上で検索します。
ソースでは、動画検索、顔・人物検索、ドキュメント検索、音声トランスクリプト検索、クロスモーダル検索のワークフローが示されています。ファイル名や手動タグではなく、コンテンツでメディアライブラリを検索したいチーム向けです。
Managed indexing は、動画、画像、音声、PDF、テキストなどの生ファイルを処理し、検索可能な特徴量と retrievers を返します。MVS は、自分のベクトルに対して dense、sparse、BM25 検索をサポートします。
料金ページでは、月額課金で長期契約のない self-serve プランに加え、カスタムインフラ、SSO、監査ログ、専任サポート付きの Enterprise オプションが説明されています。
ソースでは、ストレージの接続や SDK のインストール以外の完全な実装手順は説明されていないため、セットアップの詳細は MVS を使うか Managed indexing を使うかで変わります。
トラフィックデータは参考情報としてご利用ください。
lighton.ai
文書解析とAI検索で、根拠付き回答を提供
linguamatics.com
医療・ライフサイエンス向けAI言語・翻訳ツール
myaidrive.com
AI Driveは、法律・専門職チーム向けのクラウド文書管理・AI分析プラットフォーム。OCR、セマンティック検索、カスタムAIエージェントを備えています。
octen.ai
OctenはAIアプリケーション向けの検索インフラプラットフォームです。リアルタイムのウェブ検索、回答生成、情報抽出ツールを提供し、最新のウェブ情報を必要とするAIエージェント、コパイロット、チャットボットに対応します。
imaginario.ai
自然言語・映像・音声・台詞で動画を検索し、再活用できるAIプラットフォーム
memories.ai
Memories.aiは長期的な視覚記憶を備えたAI動画理解プラットフォームで、動画の検索・要約・分析・編集に対応し、企業のセキュリティ、メディア、マーケティング、ロボティクス業務を支援します。