Web音声文字起こしアップロード
ドラッグ&ドロップまたはファイル選択でWebアプリから音声をアップロードし、OpenAI Whisperに送って文字起こしします。
WhisperUIは、OpenAI Whisper搭載のWeb・デスクトップ音声文字起こしツールです。テキスト読み上げ、字幕出力、無料の書き起こし変換機能も利用できます。
WhisperUIは、OpenAIモデルを中心に構築された音声文字起こしおよびテキスト読み上げ製品です。主な文字起こしフローでは、ブラウザで音声ファイルをアップロードし、OpenAI Whisperに送信して、生成されたテキストまたは字幕出力を確認してダウンロードできます。
この製品には、WindowsとmacOSでのローカル文字起こし用デスクトップアプリに加え、書き起こしや字幕の形式変換、粗い書き出しの整形、文字起こし長の見積もりに使える無料のブラウザツール群も含まれています。料金ページではクラウドとローカルの両方のワークフローが案内されており、デスクトップアクセスとクラウド利用向けの有料サブスクリプションも用意されています。
ドラッグ&ドロップまたはファイル選択でWebアプリから音声をアップロードし、OpenAI Whisperに送って文字起こしします。
文字起こしをプレーンテキストとして書き出したり、音声ファイルを音声文字起こしワークフローからSRT字幕に変換したりできます。
WhisperUI Desktopを使って、無制限のジョブ、ファイルサイズ制限なし、ファイル再生時間制限なしでローカル文字起こしを行えます。
プランによって制限が異なる、ブラウザベースの処理を行いたい場合はクラウド文字起こしを選択できます。
OpenAIの音声とモデルを使って、入力したテキストから音声を生成するテキスト読み上げツールを利用できます。
無料のブラウザツールを使って、SRT、VTT、TXTの変換、粗い文字起こしのクリーニング、音声の長さからの文字起こし長推定ができます。
ブラウザベースのWhisperUI文字起こしフローを使って、アップロードした音声ファイルをメモ、確認、ダウンロード用のテキストに変換します。
文字起こしをSRT字幕に変換したり、字幕ユーティリティを使ってSRT、VTT、TXT形式を相互に変換したりできます。
処理を自分のデバイス内にとどめ、ブラウザのみの制約を避けたい場合に、デスクトップマシンでローカル文字起こしを実行します。
ポッドキャスト、インタビュー、講義、会議、大規模な音声アーカイブなど、長尺音声の継続的な作業にデスクトップアプリを使用します。
OpenAIの音声と対応する音声出力を使って、テキスト読み上げツールで書かれたテキストから音声を生成します。
WhisperUIは、一部の基本機能を無料で利用できますが、アプリを使用するには有効なOpenAI APIキーが必要で、そのキーに紐づく利用分はOpenAIに直接支払います。
ホームページに記載されている有料機能は、複数ファイルのアップロード、1日あたりのファイルアップロード無制限、音声ファイルをSRTファイルに変換する機能です。
WhisperUIはAPIキーをブラウザ内にローカル保存します。
WhisperUIは、音声文字起こし用としてMP3、MP4、MPEG、MPGA、M4A、WAV、OGG、WEBMに対応しており、テキスト読み上げツールの出力形式はMP3、AAC、FLACです。
WhisperUI Desktopは、Windows 10と11、およびIntelとApple Siliconの両方のmacOSでサポートされており、最低4GBのRAMが必要です。