網頁語音轉文字上傳
透過網頁應用以拖放或瀏覽檔案的方式上傳音訊,然後透過 OpenAI Whisper 進行轉錄。
WhisperUI 是一款由 OpenAI Whisper 驅動的網頁與桌面語音轉文字工具,支援文字轉語音、字幕輸出與免費逐字稿工具,適合創作者、研究人員、學生與團隊在本機或瀏覽器中轉錄音訊、生成字幕。
WhisperUI 是一款以 OpenAI 模型為核心打造的語音轉文字與文字轉語音產品。其核心轉錄流程可讓你在瀏覽器中上傳音訊檔,將其送至 OpenAI Whisper,並檢視產生的文字或字幕輸出以供下載。
此產品也包含可在 Windows 與 macOS 上進行本機轉錄的桌面應用程式,以及一組免費的瀏覽器工具,可用來轉換逐字稿與字幕格式、清理粗略匯出內容,並估算逐字稿長度。定價頁面顯示雲端與本機兩種工作流程,且提供可用於桌面存取與雲端使用的付費訂閱。
透過網頁應用以拖放或瀏覽檔案的方式上傳音訊,然後透過 OpenAI Whisper 進行轉錄。
將逐字稿匯出為純文字,並在語音轉文字工作流程中把音訊檔轉換為 SRT 字幕。
使用 WhisperUI Desktop 進行本機轉錄,享有無限工作次數、無檔案大小限制與無檔案時長限制。
當你想要在瀏覽器中處理時,可選擇雲端轉錄,且限制會依方案而異。
使用文字轉語音工具,透過 OpenAI 語音與模型將輸入文字生成語音。
使用免費瀏覽器工具轉換 SRT、VTT 與 TXT,清理粗略逐字稿,並依音訊長度估算逐字稿長度。
透過瀏覽器版 WhisperUI 轉錄流程,將上傳的音訊檔轉換為文字,用於做筆記、審閱或下載。
將逐字稿轉換為 SRT 字幕,或使用字幕工具在 SRT、VTT 與 TXT 格式之間互轉。
當你希望在自己的裝置上處理、並避免僅限瀏覽器的限制時,可在桌機上執行本機轉錄。
使用桌面應用程式處理重複性的長篇音訊工作,例如 podcast、訪談、講座、會議與大型音訊典藏。
使用文字轉語音工具,透過 OpenAI 語音與支援的音訊輸出,將書面文字生成語音。
WhisperUI 可免費使用部分基本功能,但你需要有效的 OpenAI API 金鑰才能使用此應用,且需直接向 OpenAI 支付與該金鑰相關的用量費用。
首頁列出的進階功能包括多檔案上傳、每日無限檔案上傳,以及將音訊檔轉換為 SRT 檔。
WhisperUI 會將你的 API 金鑰本機儲存在瀏覽器中。
WhisperUI 支援 MP3、MP4、MPEG、MPGA、M4A、WAV、OGG 和 WEBM 的語音轉文字,且其文字轉語音工具支援 MP3、AAC 和 FLAC 輸出。
WhisperUI Desktop 支援 Windows 10 與 11,以及搭載 Intel 和 Apple Silicon 的 macOS,最低需求為 4GB RAM。