研究驱动的数据集开发
采用研究式工作流开发音频数据集,从假设到设计、实验、评估、生产化和发布逐步推进。
David AI 是一家音频数据研究公司,打造用于语音和对话 AI 的专有数据集。支持 AI 实验室和企业团队申请样本、授权数据集,并合作定制音频数据设计。
David AI 是一家音频数据研究公司,开发用于语音和对话 AI 的专有数据集。网站将音频定位为希望改进的交互界面,并表示公司与顶尖 AI 实验室和财富 100 强公司合作。
其流程围绕数据集设计与验证展开:先识别要解锁的能力,再设计数据形态,执行有针对性的采集,评估信号质量,扩大数据集规模,最后发布并持续改进。因此,该产品更应被理解为数据集提供方和研究合作伙伴,而不是软件平台。
采用研究式工作流开发音频数据集,从假设到设计、实验、评估、生产化和发布逐步推进。
持续发布并维护数据集,而不是将发布视为一次性事件。
提供旗舰英文数据集 Converse,基于通道分离的自然双人对话构建,覆盖广泛主题。
提供 Atlas 多语言数据集,涵盖 15+ 种语言,并以与 Converse 相同的格式包含方言和口音元数据。
提供 Chorus,用于三人及以上对话,最初为说话人分离和语音分离模型而设计。
包括 Dialog,一个涵盖多个领域的专家对话合集,并注明可按请求提供更多专有数据集。
构建语音到语音系统的团队可以使用数据集目录,查找围绕自然对话和语音交互设计的训练数据。
本地化和多语言 AI 团队可以使用 Atlas,它覆盖 15+ 种语言,并包含方言和口音元数据。
从事语音分离或说话人分离的研究人员可以使用 Chorus,它专注于三人及以上的对话。
正在探索新的语音能力的产品团队可以申请样本、评估匹配度,然后为所需内容授权现成数据集。
需要不同数据形态的实验室可以与 David AI 合作,为特定音频 AI 能力设计定制数据集。
David AI 将自己描述为一家音频数据研究公司。它开发用于语音和对话 AI 的专有音频数据集,而不是通用软件应用。
公司表示,团队首先申请样本,然后就所需的数据集和使用场景签署数据许可协议,并在一到两天内获得现成数据集的访问权限。
首页显示,David AI 面向语音识别、翻译、合成和对话 AI 团队。其重点数据集适用于语音到语音、多语言以及语音交互系统。
可以。首页表示,公司经常与研究团队合作,为特定用例设计新的数据形态。
网站未显示公开定价详情。所收集来源中的定价 URL 返回的是 404 Not Found 页面。