預錄轉錄
為已錄製的音訊與影片提供預錄語音轉文字服務,價格依提交的音訊時數計費。
AssemblyAI 是專為開發者打造的語音 AI 基礎架構平台,提供語音轉文字、即時轉錄、語音代理、逐字稿理解、內容防護與 LLM Gateway,支援錄音與即時音訊流程。

AssemblyAI 是專為開發者打造的語音 AI 基礎架構平台,協助建立可將語音轉寫、理解並採取行動的產品。其 API 涵蓋錄音轉錄、即時轉錄、語音代理、逐字稿增強、內容防護,以及在語音工作流程中存取大型語言模型。
該網站將此產品定位為一組可投入生產環境的 API,而非單一應用程式。定價與文件依不同工作流程組織,例如預錄音訊、串流工作階段、語音代理,以及說話者區分、醫療模式與遮蔽等附加功能。
為已錄製的音訊與影片提供預錄語音轉文字服務,價格依提交的音訊時數計費。
支援通話、字幕、語音代理與 agent assist 的即時轉錄,計費方式依 WebSocket 工作階段保持開啟的時間長短而定。
將 STT、LLM 推理、TTS、輪次偵測、中斷處理與工具呼叫整合在單一 WebSocket 中,適用於語音對語音代理工作流程。
新增結構化逐字稿功能,例如說話者識別、翻譯、自訂格式化、實體偵測、情緒分析、主題偵測與摘要。
為逐字稿與音訊工作流程提供 PII 遮蔽、不雅內容過濾與內容審核等防護機制。
提供 LLM Gateway,採每個 token 計費,並支援 Anthropic、OpenAI 與 Google 模型的提示快取。
使用 pre-recorded API,將訪談、會議、Podcast 或其他音訊/影片檔轉為逐字稿,必要時再加上說話者識別、翻譯或遮蔽功能。
使用 real-time API 轉錄即時對話,適用於通話體驗、字幕、語音代理或 agent-assist 工作流程,計費依工作階段時間而定。
透過 Voice Agent API,在單一 WebSocket 中結合語音辨識、語言模型推理、輪次處理、中斷處理與 TTS,打造語音對語音代理。
運用實體偵測、情緒分析、主題偵測、摘要與自訂格式化等功能,從逐字稿中擷取結構化洞察。
在語音與逐字稿管線中套用不雅內容過濾、PII 音訊遮蔽、PII 文字遮蔽與內容審核等防護機制。
AssemblyAI 提供預錄語音轉文字、即時轉錄、Voice Agent API、Speech Understanding、Guardrails 與 LLM Gateway 的 API。該網站將其定位為供開發者建立可轉錄、理解並對語音採取行動的產品。
首頁將此平台描述為為需要可投入生產環境的 API、可擴充語音基礎架構,以及適用於音訊與語音應用的開發者友善工作流程的開發者與團隊所打造。
定價頁指出,預錄轉錄依提交的音訊時數計費,串流依工作階段持續時間計費,而 Voice Agent API 的費用為每小時 4.50 美元,或每分鐘 0.075 美元。
有。定價頁說明可獲得 50 美元免費額度且無需信用卡,並註明免費方案與隨用隨付帳戶在並發數上有所不同。
定價頁表示 EU 區域與美國同價,可透過 `api.eu.assemblyai.com` 與 `streaming.eu.assemblyai.com` 存取,並提供符合 GDPR 的資料駐留且不加價。