支援多語言且具原生代碼混用的 TTS
Chariot 以單一模型產生英文、印地語與 Hinglish 的語音,包括自然的混語輸出,而不是在不同系統之間切換。
Chariot 是一款供開發者打造語音應用的 AI 文字轉語音產品,支援英文、印地語與 Hinglish,提供低延遲串流、REST API,並有含 10,000 點數的免費方案。
Chariot 是一款供開發者打造英語、印地語與 Hinglish 語音體驗的 AI 文字轉語音產品。它強調能感知情緒與上下文的語音表現,並以單一模型同時處理「說了什麼」以及「應該怎麼說」這兩件事。
產品頁強調即時使用情境:第一段音訊大約在 75 毫秒內到達,音訊可在生成時同步串流,並提供 WebSocket 模式供逐句代理互動。網站也展示了用於輸出完成 WAV 的 REST 端點,以及用於原始 PCM 的串流端點。
Chariot 將自己定位為由開發者打造的語音系統,提供十二個工作室聲音,Starter 方案起可商業使用,且依網站說明在印度進行處理並具備完整資料駐留。定價頁顯示有一個包含 10,000 點數且不需信用卡的免費方案。
Chariot 以單一模型產生英文、印地語與 Hinglish 的語音,包括自然的混語輸出,而不是在不同系統之間切換。
此產品經過調校,可推斷文字應該如何被朗讀,因此能處理數字、縮寫、發音提示、節奏與上下文,而不需要大量手動正規化。
頁面說第一段音訊大約在 75 毫秒內到達,而且音訊會在生成過程中串流播放,因此適合即時應用。
開發者可透過 REST 生成完成的 WAV 檔案、串流原始 16 位元 PCM,或保持 WebSocket 連線以取得即時的逐句代理回應。
Chariot 提供十二個工作室聲音,頁面也顯示可依性別與口音篩選,包括印度、英國與美國口音。
定價頁提供一個含 10,000 點數且不需信用卡的免費方案,並有點數與併發限制逐步提高的更高階方案。
當產品需要幾乎即時的語音回應時使用 Chariot,例如語音代理或對話式助理,希望在短暫延遲後就開始說話,而不是等待整段渲染完成。
在建立類 IVR 流程或其他即時系統時,使用串流或 WebSocket 模式,因為逐句輸出比完成的音訊檔案更實用。
當輸入文字包含印度語言混用、縮寫、數字或其他通常在合成前需要手動正規化的表達時,使用此模型。
當你需要可下載的 WAV 檔案作為輸出音訊資產,例如已發布的片段或應用工作流程中的預先渲染語音輸出時,使用 API。
在先測試原型、之後再擴展到更高請求併發與商業使用時,使用這些定價方案。
Chariot 透過單一模型支援英文、印地語與 Hinglish。來源也提到未來會支援更多語言,但未列出具體項目。
產品頁說第一段音訊大約在 75 毫秒內到達,且串流音訊會在生成過程中開始播放。它也提供 WebSocket 模式,供逐句代理回應使用。
網站指出,自 Starter 方案起即包含商業使用權,因此生成的語音可用於產品與已發布內容。來源中提到的範例包括 YouTube、廣告和 Podcast。
可以。定價頁顯示有一個免費方案,提供 10,000 點數且不需信用卡,並可使用全部十二個工作室聲音。
Chariot 表示音訊與文字會在印度處理,具備完整的印度資料駐留與 DPDP 合規。網站聲稱你送出的任何內容都不會離開該國。
流量數據僅供參考。
| 4月 | 3496 |
|---|---|
| 5月 | 2068 |
| 6月 | 1620 |