支持多语言的 TTS,原生代码混用
Chariot 通过单一模型生成英文、印地语和 Hinglish 语音,包括自然的代码混用,而不是在不同系统之间切换。
Chariot 是面向开发者的 AI 文本转语音产品,适用于英文、印地语和 Hinglish 语音应用开发,支持低延迟流式输出、REST API 和含 10,000 credits 的免费方案。
Chariot 是面向开发者的 AI 文本转语音产品,适用于用英文、印地语和 Hinglish 构建语音体验。它围绕具备情感与上下文感知的语音进行定位,采用一个模型同时处理“说什么”和“应当如何说”的问题。
产品页面强调实时使用场景:首个音频大约在 75 毫秒内到达,音频可在生成过程中流式传输,并且提供 WebSocket 模式用于按句子的代理交互。网站还展示了用于输出完成 WAV 的 REST 端点,以及用于原始 PCM 的流式端点。
Chariot 将自己呈现为由开发者构建的语音系统,提供十二个工作室音色,Starter 方案起可用于商业用途,并且根据网站说明在印度进行处理并具有完整数据驻留。定价页面显示有一个包含 10,000 credits 且无需信用卡的免费方案。
Chariot 通过单一模型生成英文、印地语和 Hinglish 语音,包括自然的代码混用,而不是在不同系统之间切换。
产品经过调优,可推断文本应如何发声,因此能够处理数字、缩写、发音提示、语速和上下文,而无需大量手动规范化。
页面说明首个音频大约在 75 毫秒内到达,且音频会在生成过程中流式输出,这使其适合实时应用。
开发者可以通过 REST 生成完整的 WAV 文件、流式传输原始 16 位 PCM,或者保持 WebSocket 连接以接收实时的句子级代理响应。
Chariot 提供十二个工作室音色,并显示了按性别和口音筛选的选项,包括印度、英国和美国口音。
定价页面提供一个包含 10,000 credits 且无需信用卡的免费方案,并提供随 credits 和并发限制提升的更高等级方案。
当产品需要听起来几乎立即作出回应时使用 Chariot,例如语音代理或会话式助手,它们应在短暂延迟后开始说话,而不是等待完整渲染完成。
在构建 IVR 风格流程或其他实时系统时,使用流式或 WebSocket 模式,因为按句子输出比完整音频文件更有用。
当输入文本包含印度语言混用、缩写、数字或其他通常在合成前需要手动规范化的表达时,使用该模型。
当你需要可下载的 WAV 文件作为已生成音频资产时使用该 API,例如已发布的片段或应用工作流中的预渲染语音输出。
当你先测试原型,然后在验证后扩展到更高请求并发和商业用途时,使用不同定价层级。
Chariot 支持英文、印地语和 Hinglish,且来自单一模型。来源说明更多语言即将推出,但未列出具体语言。
产品页面说明首个音频大约在 75 毫秒内到达,且音频会在生成过程中持续流式输出。它还提供 WebSocket 模式,用于按句子的代理响应。
网站说明从 Starter 方案起包含商业使用权,因此生成的语音可以用于产品和已发布内容。来源提到了 YouTube、广告和播客作为示例。
可以。定价页面显示有一个包含 10,000 credits 且无需信用卡的免费方案,并且可使用全部十二个工作室音色。
Chariot 表示音频和文本在印度处理,具有完整的印度数据驻留和 DPDP 合规性。网站说明你发送的内容不会离开该国。
流量数据仅供参考。
| 4月 | 3496 |
|---|---|
| 5月 | 2068 |
| 6月 | 1620 |