网页语音转文字上传
通过拖放或文件浏览在网页应用中上传音频,然后通过 OpenAI Whisper 进行转录。
WhisperUI 是一款基于 OpenAI Whisper 的网页和桌面语音转文字工具,支持文字转语音、字幕导出和免费转录工具,适合创作者、研究者、学生和团队在本地或浏览器中转写音频、生成字幕。
WhisperUI 是一款围绕 OpenAI 模型构建的语音转文字和文字转语音产品。其核心转录流程允许你在浏览器中上传音频文件,将其发送至 OpenAI Whisper,并查看生成的文本或字幕输出以供下载。
该产品还包含一个用于在 Windows 和 macOS 上进行本地转录的桌面应用,以及一组免费的浏览器工具,可用于转换转录和字幕格式、清理粗糙导出内容,并估算转录长度。定价页面展示了云端和本地两种工作流,并提供可用于桌面访问和云端使用的付费订阅。
通过拖放或文件浏览在网页应用中上传音频,然后通过 OpenAI Whisper 进行转录。
将转录结果导出为纯文本,并在语音转文字流程中把音频文件转换为 SRT 字幕。
使用 WhisperUI Desktop 进行本地转录,支持无限任务、无文件大小限制和无文件时长限制。
当你希望在浏览器中处理时,可选择云端转录,不同套餐的限制有所不同。
使用文字转语音工具,通过输入的文本和 OpenAI 语音及模型生成语音。
使用免费的浏览器工具转换 SRT、VTT 和 TXT,清理粗糙的转录结果,并根据音频时长估算转录长度。
通过基于浏览器的 WhisperUI 转录流程,将上传的音频文件转换为文本,便于记笔记、审阅或下载。
将转录内容转换为 SRT 字幕,或使用字幕工具在 SRT、VTT 和 TXT 格式之间切换。
当你希望在自己的设备上处理并避免仅限浏览器的限制时,可在桌面设备上进行本地转录。
对于播客、采访、讲座、会议和大型音频档案等重复性的长音频工作,可使用桌面应用。
使用文字转语音工具,借助 OpenAI 语音和支持的音频输出,将书面文本生成语音。
WhisperUI 可免费使用部分基础功能,但你需要一个可用的 OpenAI API 密钥来使用该应用,并且需要直接向 OpenAI 支付与该密钥关联的使用费用。
主页上列出的高级功能包括多文件上传、每日无限文件上传,以及将音频文件转换为 SRT 文件。
WhisperUI 会将你的 API 密钥本地存储在浏览器中。
WhisperUI 支持用于语音转文字的 MP3、MP4、MPEG、MPGA、M4A、WAV、OGG 和 WEBM,文字转语音工具支持 MP3、AAC 和 FLAC 输出。
WhisperUI Desktop 支持 Windows 10 和 11,以及搭载 Intel 和 Apple Silicon 的 macOS,最低需要 4GB 内存。