研究主導のデータセット開発
仮説から設計、実験、評価、実運用化、公開までを進める研究型ワークフローで音声データセットを開発します。
David AIは、音声・会話AI向けの独自データセットを構築する音声データ研究企業です。AIラボや企業向けにサンプル依頼、データセットのライセンス取得、カスタム音声データ設計の共同開発を支援します。
David AIは、音声・会話AI向けの独自データセットを開発する音声データ研究企業です。サイトでは音声を改善したいインターフェースとして位置づけており、同社がトップクラスのAIラボやFortune 100企業と連携していると説明しています。
そのプロセスはデータセットの設計と検証を中心に構成されています。解決したい能力を特定し、データの形を設計し、対象を絞った収集を行い、シグナル品質を評価し、データセットを拡張し、公開して継続的に改善します。したがって、この製品はソフトウェアプラットフォームというより、データセット提供者および研究パートナーとして理解するのが最適です。
仮説から設計、実験、評価、実運用化、公開までを進める研究型ワークフローで音声データセットを開発します。
リリースを一度きりの出来事として扱わず、時間をかけてデータセットを公開・維持します。
チャネル分離された自然な2話者会話を、幅広いトピックにわたって収録したフラッグシップ英語データセットConverseを提供します。
Converseと同じ形式で、方言とアクセントのメタデータを含む15以上の言語を網羅した多言語データセットAtlasを提供します。
3人以上の話者による会話向けのChorusを含み、もともとは話者分離およびダイアリゼーションモデル向けに設計されています。
複数分野にわたる専門家同士の会話を集めたDialogや、追加の独自データセットはリクエストに応じて利用可能であることを含みます。
音声対音声システムを構築するチームは、自然な会話と音声インタラクションを軸に設計された学習データを、データセットカタログから見つけることができます。
ローカライゼーションや多言語AIのチームは、15以上の言語をカバーし、方言とアクセントのメタデータを含むAtlasを活用できます。
ダイアリゼーションや話者分離に取り組む研究者は、3人以上の話者を含む会話に焦点を当てたChorusを利用できます。
新しい音声機能を検討している製品チームは、サンプルを依頼し、適合性を確認したうえで、既製データセットのライセンスを取得して利用できます。
異なるデータ形状を必要とするラボは、David AIと協力して特定の音声AI機能向けのカスタムデータセットを設計できます。
David AIは、音声・会話AI向けの独自音声データセットを開発する音声データ研究企業です。汎用的なソフトウェアアプリではありません。
同社によると、チームはまずサンプルを依頼し、その後、必要なデータセットとユースケースに応じたデータライセンス契約を結び、1〜2日以内に既存データセットへのアクセスを受けます。
ホームページでは、David AIは音声認識、翻訳、合成、会話AIのチームと連携していると説明しています。掲載されているデータセットは、音声対音声、多言語、音声インタラクションの各システム向けに設計されています。
はい。ホームページでは、同社が特定のユースケースに向けた新しいデータ形状の設計について、研究チームと頻繁に協業していると説明しています。
公開されている価格情報はサイト上に表示されていません。収集したソース内の料金URLは404 Not Foundページを返します。